মডেল ও ইন্টারফেস
Claude Haiku 5.5. অ্যানথ্রোপিকের নতুন দ্রুত ও কম-খরচের মডেলটি ১ মিলিয়ন টোকেনের কনটেক্সট দেয় এবং ১০০ হাজার টোকেন পর্যন্ত প্রম্পটের দাম প্রতি মিলিয়নে ০.১০ ডলারে নামিয়ে এনেছে, যা GPT-6 Luna-র সঙ্গে মেলে। তবে এর টোকেনাইজার প্রায় ২৫-৩০% বেশি টোকেন গুনে এবং ১০০ হাজার টোকেনের পরে দাম ৫ গুণ বেড়ে যায়। বেঞ্চমার্কে Haiku 4.5-র চেয়ে বড় লাফ এবং প্রতিযোগিতামূলক এজেন্টিক কোডিং দেখা যাচ্ছে।
Mistral Large 4 ‘Le Chonk’. Mistral প্রিভিউতে ১ ট্রিলিয়ন প্যারামিটারের ওপেন-ওয়েট মডেল প্রকাশ করেছে, যা কোডিং, সাইবার প্রতিরক্ষা ও নির্দিষ্ট ইন্ডাস্ট্রির জন্য অপ্টিমাইজ করা। কোম্পানির দাবি, এর সক্ষমতা মার্কিন ও চীনা ফ্রন্টিয়ার মডেলের কাছাকাছি।
Liquid AI ডিসিশন মডেল. Liquid AI d1-3B ও d1-omni-600M ওপেন-সোর্স করেছে—মাল্টিমোডাল ডিসিশন মডেল, যা শূন্য আউটপুট টোকেনে ক্যালিব্রেটেড হ্যাঁ/না, চয়েস বা স্কোর উত্তর দেয়। d1-3B Decision Index-এ ১০B-এর নিচে বেস্ট-ইন-ক্লাস হওয়ার দাবি করে এবং NVIDIA Jetson হার্ডওয়্যারে মাত্র ১৬ মিলিসেকেন্ডে চলে; একটি WebGPU ব্রাউজার পোর্টও এসেছে।
OpenAI Decisions API. OpenAI টেক্সট বা ইমেজে হ্যাঁ/না, ক্যাটেগরিক্যাল ও স্কেল মূল্যায়নের জন্য বেটা Decisions API চালু করেছে, যা Responses-এর চেয়ে প্রায় ১০ গুণ দ্রুত। এটি GPT-6 Luna সমর্থন করে—ইনপুট প্রতি মিলিয়নে ০.১০ ডলার, আউটপুট টোকেন ফ্রি।
ChatGPT ইন্টেলিজেন্ট UI. GPT-6-এর সঙ্গে ChatGPT সাধারণ টেক্সটের বদলে ইন্টারঅ্যাকটিভ চার্ট, বাটন, ফর্ম ও মিনি অ্যাপ আউটপুট দিতে পারে। OpenAI বলছে, অপেক্ষার সময় কমাতে থিংকিংয়ের মধ্যেই রিজনিং শুরু হয়; পেইড ইউজাররা GPT-6 Sol পান, আর ফ্রি ইউজাররা পান Luna।
Kandinsky 6.0 ভিডিও জেনারেশন. Kandinsky Lab Kandinsky 6.0 Pro (29B) ও Lite (3B) প্রকাশ করেছে, যাতে ComfyUI ও Diffusers সাপোর্ট আছে এবং একটি ভিডিও আপস্কেলার যোগ করা হয়েছে।
Nemotron প্রতিযোগিতার ফলাফল. ফাইন-টিউন করা Nemotron মডেল SFT, RL ও generate-verify-refine ব্যবহার করে IOI 2026-এ গোল্ড-লেভেল আনঅফিশিয়াল ফলাফল (৫৩৫.৪/৬০০) এবং IMO 2026-এ অফিশিয়াল গোল্ড স্কোর ৩০/৪২ পেয়েছে।
এজেন্ট ও ফ্রেমওয়ার্ক
Nous Research এজেন্ট. Nous Research ১.৫ বিলিয়ন ডলার ভ্যালুয়েশনে ৯০ মিলিয়ন ডলার তহবিল সংগ্রহ করেছে এবং এন্টারপ্রাইজ এআই এজেন্ট লক্ষ্য করে Hermes for Businesses চালু করেছে। এর ওপেন-সোর্স Hermes Agent ২৪ মিলিয়ন বার ক্লোন হয়েছে এবং অনুমান অনুযায়ী বিশ্বের এআই টোকেন ব্যবহারের ২.৫% চালায়।
LangChain Deep Agents. LangChain Skills আপডেট এনেছে, যা টুলগুলোকে স্কিলের সঙ্গে বেঁধে কনটেক্সট ছোট রাখে; সঙ্গে এজেন্ট-তৈরি শিডিউল, প্রতি-রান কনফিগারেশন ও Slack রিঅ্যাকশনসহ Managed Deep Agents v0.9-ও এসেছে।
Microsoft Copilot অ্যাকশন. Microsoft-এর Hybrid Intelligence Copilot-কে লোকাল ফাইল অ্যাক্সেস করতে এবং Windows জুড়ে অ্যাকশন নিতে দেবে—যেমন ব্যবহারকারীর জন্য ডকুমেন্ট খোঁজা, নাম বদলানো, জিপ করা ও ইমেল করা।
Meta Muse iPad. Meta-র এজেন্ট অ্যাসিস্ট্যান্ট Muse এখন নেটিভ iPad সাপোর্ট পেয়েছে, ৬.৬ মিলিয়ন ইনস্টল ছুঁয়ে ফেলার পর; সঙ্গে Canva, GitHub, QuickBooks-এর মতো টুলের কানেক্টর যোগ করেছে।
Agent Lightning RL. Microsoft Research Agent Lightning v1.0 ওপেন-সোর্স করেছে—৩,৫০০ লাইনের এজেন্টিক RL ফ্রেমওয়ার্ক, যা বাস্তব ডিপ্লয়মেন্ট হার্নেস ও নেটিভ Kubernetes ব্যবহার করে। একটি উদাহরণে, প্রায় ৬,০০০ ট্রেনিং স্যাম্পল দিয়ে SWE-bench Verified-এ Qwen3.5-9B-র Pass@1 ৪১.৮% থেকে ৫৬.৪%-এ উঠিয়েছে।
লোকাল এআই ও ডেভেলপার টুলস
ROCm 10.1. AMD-র ROCm 10.1 লোকাল ইনফারেন্সে ডেটা-মুভমেন্টের বটলনেককে লক্ষ্য করে; রিলিজটি Reddit-এ লোকাল এআই ব্যবহারকারীরা আলোচনা করছেন।
llama.cpp MoE স্পিডআপ. llama.cpp হোস্ট মেমরিতে রাখা MoE এক্সপার্টদের জন্য GPU ক্যাশ পেয়েছে, যা VRAM-এ পুরোপুরি না-ফিট হওয়া মডেলের জন্য বড় স্পিডআপের প্রতিশ্রুতি দেয়; সঙ্গে GLM5Next MTP সাপোর্ট যোগ হয়েছে।
Unsloth Studio রিপো চেক. Unsloth Studio এখন চালানোর আগে বিশ্বস্ত মডেল রিপোজিটরি আবার চেক করে; কারণ PyPI-তে ক্ষতিগ্রস্ত LiteLLM সংস্করণ দেখিয়েছে কীভাবে সাপ্লাই-চেইন আক্রমণ এআই টুলিং পর্যন্ত পৌঁছাতে পারে।
GLM-5.3-Flash ডুয়াল-GPU. দুটি CMP 170HX 64GB-র সেটআপ EXL3 ব্যবহার করে GLM-5.3-Flash ৩৮৪ হাজার টোকেন কনটেক্সটে এবং প্রায় ৯০ টোকেন/সেকেন্ডে চালায়; ৩২০B MoE অ্যাক্টিভ ওয়েট HBM-এ রাখে এবং Qwen3.8-Flash-Next-এর বিরুদ্ধে বেঞ্চমার্ক করে।
লোকাল Qwen বেঞ্চমার্ক. সাম্প্রতিক কমিউনিটি মূল্যায়নে Qwen3.8-27B ফাইন-টিউন ও Qwen3.8-Flash-Next-কে ডোমেইন-নির্দিষ্ট এবং কোডিং টাস্কে ফ্রন্টিয়ার মডেলের সঙ্গে তুলনা করা হয়েছে। ৪৬৯ প্রশ্নের একটি ইভালে দেখা গেছে, লোকাল মডেল গোপনীয়তা ও কম খরচে ফ্রন্টিয়ার আউটপুটের কাছাকাছি পৌঁছাতে পারে; তবে থিংকিং-টোকেনের অতিরিক্ত ব্যবহার এখনও একটি সমস্যা।
হার্ডওয়্যার ও উইন্ডোজ
Surface এআই হার্ডওয়্যার. Microsoft Surface Laptop Ultra ও Surface RTX Spark Dev Box ঘোষণা করেছে; দুটোই Nvidia-র Arm-ভিত্তিক RTX Spark চিপে তৈরি। ল্যাপটপের দাম শুরু ২,৫৯৯ ডলার থেকে, সর্বোচ্চ ১২৮GB ইউনিফাইড মেমরি, ১৬ অক্টোবর থেকে শিপিং; Dev Box-এর দাম শুরু ৫,৯৯৯ ডলার থেকে এবং ১২০B+ লোকাল মডেল চালানোর লক্ষ্যে তৈরি।
ইন্ডাস্ট্রি ও ব্যবসা
এআই কোড বোঝার ব্যবধান. ৩০০ সিনিয়র ইঞ্জিনিয়ারিং লিডারের একটি সার্ভেতে দেখা গেছে, এআই কোডিং এজেন্ট বটলনেককে ডিবাগিং ও বোঝার দিকে সরিয়ে দিয়েছে: দলগুলো এখন কোড লেখায় সপ্তাহে ৯.৮ ঘণ্টা, কিন্তু ডিবাগিংয়ে ১৬.৯ ঘণ্টা ব্যয় করে। প্রতিবেদনে মিশন-ক্রিটিক্যাল কোডবেসে বাড়তে থাকা ঝুঁকির কথা বলা হয়েছে।
ভার্চুয়াল সেল উদ্যোগ. Biohub কোষের আচরণ পূর্বাভাস দিতে পারে এমন এআই মডেল তৈরির ১.৮ বিলিয়ন ডলারের উদ্যোগ সমন্বয় করছে। Google DeepMind, Meta ও Isomorphic Labs ৩০০ মিলিয়ন ডলার বিনিয়োগ করছে, আর US DOE ল্যাব পরিমাপ ও কম্পিউটের জন্য ৫০০ মিলিয়ন ডলারের বেশি দিচ্ছে।
Adobe ওপেন সোর্স ক্লোন. ডেভেলপার Brandon Thomas Claude Opus 5.5 দিয়ে Artcraft তৈরি করেছেন—সাতটি ওপেন-সোর্স Rust/WebAssembly অ্যাপের স্যুট, যা Adobe-র Photoshop, Illustrator, Premiere প্রভৃতির ক্লোন। অ্যাপগুলো প্রাথমিক এবং এখনও অনেক ঘাটতি আছে, তবে প্রকল্পটি এআই-সহায়ক ক্লিন-রুম রিইমপ্লিমেন্টেশন দেখায়।
SynthID পাবলিক ডিটেক্টর. Google তার SynthID ডিটেক্টর জনসাধারণের জন্য খুলে দিয়েছে, যাতে যে কেউ ছবি, ভিডিও ও অডিওতে Google বা অংশীদারের ওয়াটারমার্ক আছে কি না দেখতে পারে। সিস্টেমটি ইতিমধ্যে ১৮০ বিলিয়নের বেশি মিডিয়া আইটেম চিহ্নিত করেছে এবং Chrome ও Gemini-তেও বিল্ট-ইন আছে।
Google Playground গেম. Google Labs Playground চালু করেছে—ব্রাউজার-ভিত্তিক প্ল্যাটফর্ম, যেখানে মার্কিন প্রাপ্তবয়স্করা টেক্সট প্রম্পট থেকে গেম তৈরি করতে পারেন; এটি Gemini, Nano Banana ও Lyria দ্বারা চালিত। Unity-ও পেশাদার এআই-সহায়ক গেম ডেভেলপমেন্টের জন্য Unity Spark ঘোষণা করেছে।
আজকের জন্য এতটুকুই - প্রায় ৫ মিনিটের পড়া।