ডিসিশন মডেল ও স্ট্রাকচার্ড আউটপুট
Jev ও ডিসিশন মডেল. TypeSafe AI Jev প্রকাশ করেছে—শুধু ডিসিশন নেওয়ার মডেল, যা টাইপড প্রোবাবিলিটি ফেরত দেয়। কয়েক দিনের মধ্যেই AWS, Cloudflare ও Perplexity নিজেদের ওপেন ডিসিশন মডেল ছেড়েছে। বিদ্যমান স্ট্রাকচার্ড আউটপুট/গ্রামার এনফোর্সমেন্টই ইতিমধ্যে একই ধরনের কনস্ট্রেইনড জেনারেশন দেয়।
- → TypeSafe AI Releases Jev: A Decision-Only Model That Returns Typed Probabilities Instead of Text
- → Amazon releases its own Jev clone as decision models flood the web
- → Clef: Open Weights decision model by Cloudflare
- → Perplexity Decider 27B: Open weights decision model fine tune of Qwen3.8 27B
- → Guys... OpenAI API on VLLM and Llamacpp already supported grammar enforcer... (AKA JEV)
লোকাল ডিসিশন LoRA. Jeff-Qwen3.5-0.8B নয়টি LoRA অ্যাডাপ্টার নিয়ে প্রম্পট ইনজেকশন ও টুল চয়েসের মতো বারবার আসা এজেন্ট-সিদ্ধান্ত সামলায়—৩৮ গুণ গতি ও +৮.৭ অ্যাকুরেসি, অথচ ২ জিবি-এর কম অতিরিক্ত মেমোরি লাগে।
এজেন্ট ও প্রোডাক্ট রিলিজ
OpenAI Dots বনাম Meta Muse. OpenAI Dots নামে একটি কিউট GPT-6 Astra-চালিত এজেন্ট ঘোষণা করেছে, যা ভার্চুয়াল ওয়ার্ল্ড বানাতে পারে; তবে এটি মাসে ১ ডলারের প্ল্যানে সীমাবদ্ধ, আর তার প্রতিদ্বন্দ্বী Meta-র ফ্রি Muse।
Shopify Canvas. Shopify Canvas চালু করেছে, যা মার্চেন্টদের AI Sidekick-এর সঙ্গে চ্যাট করে স্টোর বানাতে দেয়; আসল কোড রিয়েল-টাইমে রেন্ডার হয়।
ChatGPT ভার্চুয়াল ট্রাই-অন. OpenAI ChatGPT শপিংয়ে ভার্চুয়াল ট্রাই-অন ও ফেভারিট করার সুবিধা যোগ করেছে; Images 2.5 মডেল ব্যবহার করে ব্যবহারকারীর ছবিতে পোশাক কেমন দেখাবে তা দেখানো হয়।
Tavus Griffin অ্যাভাটার. Tavus Griffin নামের রিয়েল-টাইম ভিডিও অ্যাভাটার মডেল উন্মোচন করেছে; এক মিনিটের কলে পরীক্ষায় ৪৮% অংশগ্রহণকারী এটিকে মানুষ ভেবেছেন।
Photon অ্যাপের শেষকৃত্য. Photon মোবাইল অ্যাপের শেষকৃত্য করেছে এবং ৪.৫ মিলিয়ন ডলার তুলেছে, যাতে ডেভেলপাররা iMessage/WhatsApp-এ চালানো মেসেজিং-ভিত্তিক এজেন্ট বানাতে পারেন।
ওপেন মডেল ও লোকাল AI
Gemini 4 Argon. Google DeepMind Gemini 4 Argon উন্মোচন করেছে—SOTA বেঞ্চমার্ক ও সর্বোচ্চ ১০ লাখ আউটপুট টোকেন, শুরুতে শুধু সাইবারসিকিউরিটি প্রিভিউয়ে।
K2 Horizon ওপেন ফ্লিট. IFM K2 Horizon প্রকাশ করেছে—0.9B থেকে 375B পর্যন্ত ছয়টি ওপেন মডেল, সঙ্গে ট্রেনিং ডেটা, কোড ও লগ; ওপেন ডেভেলপমেন্ট নিয়ে দলের AMA।
Qwen Flash Next MTP. llama.cpp Qwen Flash Next-এর জন্য মাল্টি-টোকেন প্রেডিকশন সাপোর্ট মার্জ করেছে, যা ইনফারেন্সের গতি বাড়ায়।
Mac-এর জন্য Slipstream. Slipstream, একটি Metal ইনফারেন্স ইঞ্জিন, ৬৪ জিবি Mac-এ ৯৫.৫ গিবিবাইট Qwen3.8-Flash-Next চালায় ৪১-৫২ টোকেন/সেকেন্ডে; llama.cpp-এর চেয়ে ১.৭৬ গুণ দ্রুত, লম্বা কনটেক্সটেও স্থিতিশীল।
Olmo-core 3. Allen AI Olmo-core 3 প্রকাশ করেছে—ট্রিলিয়ন-প্যারামিটার MoE মডেলের জন্য ওপেন, স্কেলেবল ট্রেনিং ইনফ্রাস্ট্রাকচার।
রিসার্চ ও বেঞ্চমার্ক
Stratego-কে হারাল Ataraxos. CMU/MIT/NYU/Stanford-এর গবেষকরা Ataraxos বানিয়েছেন, যা সেরা Stratego খেলোয়াড়কে ১৫-১ ব্যবধানে হারিয়েছে, ৪টি ড্র হয়েছে; মানুষের একাধিপত্যের অবসান ঘটিয়েছে; ট্রেনিং খরচ ৮ হাজার ডলারেরও কম।
Agentic RAG-এর জয়. FRAMES-এ ১৮টি RAG পাইপলাইন বনাম একটি এজেন্ট লুপের বেঞ্চমার্ক: সেরা পাইপলাইন ৭৮.৯%, এজেন্ট লুপ ৯২.৭%—অর্থাৎ রিট্রিভাল এজেন্ট ফিক্সড পাইপলাইনের চেয়ে এগিয়ে।
AutoSynthData. ServiceNow CoreAI AutoSynthData বানিয়েছে, যা মডেলের ব্যর্থতা ও টিচারের সাফল্য থেকে ট্রেনিং ডেটা তৈরি করে এন্টারপ্রাইজ এজেন্ট উন্নত করে।
AI লেখার চিহ্ন. Graphite ১৩,০০০ ফ্রেজ খুঁজে পেয়েছে, যেগুলো AI-এর চিহ্ন; Claude মডেল মানুষের শব্দবিন্যাসের আরও কাছে আসছে, GPT আরও দূরে সরে যাচ্ছে।
ইন্ডাস্ট্রি, পলিসি ও সিকিউরিটি
Google-এর অ্যান্টিট্রাস্ট মামলা খারিজ. বিচারক Chegg ও Penske-এর মামলা খারিজ করেছেন, যেখানে অভিযোগ ছিল Google AI Overviews বেআইনিভাবে ট্রাফিক কমিয়েছে; অ্যান্টিট্রাস্ট দাবি টেকেনি।
ভেনেজুয়েলায় Grok-এর প্রভাব. Time জানিয়েছে, ভেনেজুয়েলা আক্রমণের আগে ট্রাম্প ঘণ্টার পর ঘণ্টা Grok-এর সঙ্গে কথা বলেছেন; Grok উৎসবের পূর্বাভাস দিয়ে ট্রাম্পের ধারণাকে আরও পোক্ত করেছে।
OpenAI সেফটি গবেষক বিদায়. OpenAI তিনজন সেফটি গবেষকের সঙ্গে সম্পর্ক ছিন্ন করেছে; অভিযোগ, তারা তৃতীয় পক্ষের একটি সেফটি সংস্থার সঙ্গে গোপন তথ্য শেয়ার করেছেন।
Anthropic সরকারি খাতে. Anthropic FedRAMP High পরিবেশে বেসামরিক সংস্থার জন্য Claude for Government চালু করেছে; আইনি লড়াইয়ের মধ্যেও পেন্টাগনের নিষেধাজ্ঞা বহাল।
মহাকাশে ডেটা সেন্টার. Google TPU-যুক্ত প্রোটোটাইপ অরবিটাল কম্পিউট স্যাটেলাইট উৎক্ষেপণ করেছে; Satlyt স্যাটেলাইট AI-এর সফটওয়্যার বানাতে ৮ মিলিয়ন ডলার তুলেছে; স্কেল করতে Starship লাগবে।
এজেন্টের স্ক্রিনশট লিক. Glow Security দেখেছে, AI এজেন্টরা পাবলিক GitHub রিপোতে ১৩,০০০-এর বেশি অভ্যন্তরীণ স্ক্রিনশট আপলোড করেছে, যেখানে কাস্টমার ডেটা ও ক্রেডেনশিয়াল ফাঁস হয়েছে।
রিজনিং চুরির অভিযান. OpenAI বলেছে, সুরক্ষিত রিজনিং টার্গেট করে চালানো অ্যাডভার্সারিয়াল ডিস্টিলেশন অভিযান তারা থামিয়েছে; তবে একই কৌশল Azure-এ এখনও কাজ করেছে।
আজকের জন্য এতটুকুই - প্রায় ৫ মিনিটের পড়া।