মডেল ও এজেন্ট রিলিজ
Gemini Live অ্যাভাটার. Google এন্টারপ্রাইজ ব্যবহারকারীদের জন্য Gemini 3.8 Live-এ রিয়েল-টাইম অ্যানিমেটেড অ্যাভাটার যোগ করেছে। এতে ৯৭টি ভাষায় লিপ-সিঙ্কিং এবং কাস্টম কোম্পানি অ্যাভাটারের অপশন রয়েছে। ফিচারটি গ্রাহকসেবা বা গাইডেড ওয়াকথ্রুর জন্য প্রায় রিয়েল-টাইম ভিডিও জেনারেশনকে ভয়েসের সঙ্গে মিলিয়ে দেয়।
Gemini ব্যবসায় কল করবে. Google Pixel 11-এর একটি ফিচার পরীক্ষা করছে, যা Gemini-কে ব্যবসায়িক প্রতিষ্ঠানে কল করতে, ফোন মেনু নেভিগেট করতে, হোল্ডে থাকতে এবং কথাবার্তা সামলাতে দেবে। এতে লাইভ ট্রান্সক্রিপ্ট থাকবে এবং ব্যবহারকারীরা চাইলে নিজে দায়িত্ব নিতে পারবেন।
Meta-র Muse এজেন্ট. Meta-র নতুন AI এজেন্ট Muse অ্যাপ চার্টের শীর্ষে উঠেছে এবং Tamagotchi-ধরনের Charm অ্যাকসেসরি তৈরি করেছে। তবে গবেষকরা সহজেই এটিকে প্ররোচিত করে তার ফাইলসিস্টেম এক্সপোর্ট করিয়েছেন এবং লক্ষ করেছেন, এটি OpenClaw-এর সঙ্গে খুব মিল। Meta বলছে, VM ফাইল এক্সপোর্ট অবকাঠামোর প্রিভিলেজড অ্যাক্সেস দেয় না।
Runway-র WorldPrompt. Runway তার GWM Worlds 2 রিসার্চ প্রিভিউয়ের জন্য WorldPrompt বিস্তারিত জানিয়েছে। এটি এমন একটি ইনপুট ফরম্যাট, যা সিমুলেটেড বিশ্বের কিছু অংশ স্থির রাখে এবং টাইমস্ট্যাম্পযুক্ত ইভেন্ট শিডিউল করে; ফলে রিয়েল-টাইম ইন্টারঅ্যাকটিভ ভিডিও ও অডিও জেনারেশন সম্ভব হয়।
ওপেন রোবোটিক্স মডেল. Black Forest Labs FLUX 3 Action প্রকাশ করেছে। এটি রোবোটিক্সের জন্য একটি ওপেন ৭B-প্যারামিটারের ওয়ার্ল্ড-অ্যাকশন মডেল, যা মাল্টি-ক্যামেরা ভিডিও থেকে পরবর্তী অ্যাকশন পূর্বাভাস দেয় এবং RoboLab-120-এ রেকর্ড গড়ে, একইসঙ্গে ৩.৯৫ গুণ পর্যন্ত দ্রুত চলে।
চশমায় ছোট LLM. PrismML Qualcomm Snapdragon AR1 স্মার্ট চশমায় ১-বিট Bonsai 2B ভিশন-ল্যাঙ্গুয়েজ মডেল প্রদর্শন করেছে। এটি ডিভাইসেই রিয়েল-টাইম ভিজ্যুয়াল প্রশ্নোত্তরের জন্য, যার লক্ষ্য ওপেন-ওয়েট ও গোপনীয়তা রক্ষাকারী এজ AI।
ইন্ডাস্ট্রি ও ব্যবসা
Lightspeed-র ভারত AI ফান্ড. Lightspeed AI-কেন্দ্রিক নতুন একটি প্রাথমিক পর্যায়ের ভারত ফান্ডের জন্য ২৫০ মিলিয়ন ডলার লক্ষ্যমাত্রা ঠিক করেছে। এর আকার ২০২২ সালের পূর্ববর্তী ফান্ডের প্রায় অর্ধেক; দুই মাসের মধ্যে বিনিয়োগ শুরু হওয়ার কথা।
Vibe coding আয়. Lovable বার্ষিকীকৃত আয়ে ৬০০ মিলিয়ন ডলার ছাড়িয়েছে, যা জুনে ছিল ৫০০ মিলিয়ন ডলার। কোম্পানির দাবি, Fortune 500-এর দুই-তৃতীয়াংশ কোম্পানি তাদের ভাইব-কোডিং প্ল্যাটফর্ম ব্যবহার করে।
AI অগ্রগতি পূর্বাভাস ছাড়িয়ে. Epoch AI বলছে, একটি নির্দিষ্ট AI বেঞ্চমার্ক স্কোরে পৌঁছানোর খরচ প্রতি ত্রৈমাসিকে প্রায় ৪৭% কমছে (বছরে প্রায় ১৩ গুণ)। অন্যদিকে MIT গবেষকদের হিসাবে, হার্ডওয়্যার ও মূল্যের সমন্বয়ের পর অ্যালগরিদমিক দক্ষতার বার্ষিক বৃদ্ধি প্রায় ৩ গুণ। আলাদা একটি Forecasting Research Institute প্রতিবেদনে বলা হয়েছে, বিশেষজ্ঞরা AI-এর মাইলফলক যথেষ্ট কম অনুমান করেছিলেন; গণিতে স্বর্ণপদক মানের পারফরম্যান্স ৫–১০ বছর আগেই এসেছে।
Sakana-র নতুন উপদেষ্টা. টোকিওভিত্তিক Sakana AI জুর্গেন শ্মিডহুবারকে প্রধান বৈজ্ঞানিক উপদেষ্টা নিয়োগ করেছে। কোম্পানিটি তার ওয়ার্ল্ড মডেল, ডিপ লার্নিং ও মেটা-লার্নিং-এর প্রাথমিক কাজকে Darwin Gödel Machine ও AI Scientist-এর মতো প্রকল্পে প্রভাব হিসেবে উল্লেখ করেছে।
ElevenLabs-এর ৬০০ মিলিয়ন গতি. ElevenLabs বলছে, তাদের বার্ষিক পুনরাবৃত্ত আয় ৬০০ মিলিয়ন ডলারের গতিতে এগোচ্ছে এবং কোম্পানির মূল্য ২২ বিলিয়ন ডলার। কোম্পানির CEO-র যুক্তি, কোনো AI-এর সঙ্গে কথা বললে ব্যবসাগুলোর গ্রাহকদের তা জানানো উচিত।
অবকাঠামো ও নীতি
ডেটা সেন্টার জেনারেটরে জরিমানা. ড্রোনের থার্মাল ছবিতে পূর্ব উপকূলের একটি ডেটা সেন্টারে ৬২টি অনুমতিহীন গ্যাস জেনারেটর চলতে ধরা পড়ার পর নিউ জার্সি DataOne-কে ১.১ মিলিয়ন ডলার জরিমানা করেছে। কয়েকটির মাত্রা অনুমোদনের সীমার চেয়ে ৫০ গুণেরও বেশি ছিল।
Oracle-র Stargate হেজ. Oracle তার নিউ মেক্সিকো-র Stargate ডেটা সেন্টার ক্যাম্পাসে ফোর্স ম্যাজিওর নোটিশ পাঠিয়েছে, যাতে সুবিধাটি ২০২৮ সালের লক্ষ্য মিস করলে পেমেন্ট বিলম্বিত করা যায়। তবে Oracle বলছে, Project Jupiter নির্ধারিত সময়সূচিতেই আছে।
Google-র অরবিটাল ডেটা সেন্টার. Google-এর Project Suncatcher ১ অক্টোবর চারটি TPU-সহ রেফ্রিজারেটর আকারের একটি স্যাটেলাইট উৎক্ষেপণ করবে, যাতে সৌরশক্তিচালিত অরবিটাল AI ডেটা সেন্টার পরীক্ষা করা যায়। তবে ১ গিগাওয়াট ক্ষমতার একটি স্থলভিত্তিক ডেটা সেন্টারের সমান হতে আনুমানিক ১০,০০০ স্যাটেলাইট লাগবে।
সুপারইন্টেলিজেন্স নিষিদ্ধে বিল. সিনেটর বার্নি স্যান্ডার্স ও গ্রেগ কাসার Ban Artificial Superintelligence Act উত্থাপন করেছেন। এই বিলে কৃত্রিম সুপারইন্টেলিজেন্স স্থায়ীভাবে নিষিদ্ধ করা, নতুন একটি ফেডারেল এজেন্সি গঠন পর্যন্ত উন্নত AI উন্নয়ন স্থগিত রাখা এবং লঙ্ঘনে সর্বোচ্চ ২০ বছর কারাদণ্ডের বিধান রয়েছে।
হুয়াংয়ের জলবায়ু দ্বন্দ্ব. Nvidia CEO জেনসেন হুয়াং বলেছেন, AI জলবায়ু পরিবর্তনের মোকাবিলায় সাহায্য করতে পারে, তবে তা ‘অপরিমেয় যন্ত্রণা ও কষ্ট’ দেওয়ার পরেই। এই মন্তব্য অ্যাক্সিলারেশনিস্ট প্রচারের জন্য সমালোচনার জন্ম দিয়েছে।
গবেষণা ও নিরাপত্তা
OpenAI এজেন্ট ব্রিচ. অভ্যন্তরীণ পরীক্ষার সময় একটি OpenAI এজেন্ট Medicare-এর অপ্রকাশিত পরিসংখ্যান ফাইল অ্যাক্সেস করেছে। ঘটনাটিকে অগ্রহণযোগ্য বলেছেন অস্ট্রেলিয়ার প্রধানমন্ত্রী অ্যান্থনি আলবানিজ; তিনি স্যাম অল্টম্যানের কাছে উদ্বেগ জানিয়েছেন।
Claude-এর এনজাইম আবিষ্কার. Anthropic বলছে, ৯৫০টি AI এজেন্ট ২,০০,০০০-এর বেশি রিভার্স ট্রান্সক্রিপ্টেজ খুঁজে দেখার পর Claude CRISPR-সদৃশ একটি নতুন এনজাইম সিস্টেম শনাক্ত করেছে। তবে CRISPR গবেষকরা এটিকে রুটিন জিনোম মাইনিং বলছেন এবং সিস্টেমটির কার্যকারিতা এখনও অজানা বলে উল্লেখ করছেন।
দুর্বৃত্ত এজেন্ট এয়ার-গ্যাপিং. গবেষকদের যুক্তি, AI এজেন্টকে ইন্টারনেট থেকে দূরে রাখতে এয়ার-গ্যাপিং করলে নিরাপত্তা পরীক্ষা আরও নিরাপদ হয়, কিন্তু কম বাস্তবসম্মত হয়ে পড়ে। তারা এটিকে মৌলিক কারিগরি সমাধান নয়, বরং একটি দ্বন্দ্ব বলে বর্ণনা করেন।
টুল ও ওপেন মডেল
LangChain এজেন্ট টুলিং. LangChain রেড-টিমিং ও স্বয়ংক্রিয় সংশোধনের জন্য Engine v2, এজেন্ট সেশন পড়ার উপযোগী LangSmith Trajectories, ব্যবহারকারীর নিজস্ব ক্রেডেনশিয়াল ও মেমোরিসহ Managed Deep Agents 0.8, একটি Fine-Tuning CLI এবং Custom Apps প্রকাশ করেছে।
- → New in LangSmith Engine: red teaming and automated testing
- → Trajectories now in LangSmith: A readable view of every agent session
- → Managed Deep Agents delivers a better user experience for agents in production
- → Introducing LangSmith Fine-Tuning
- → LangSmith Custom Apps: Build custom interfaces around your agent data
OpenVINO CPU ইনফারেন্স. Laya OpenVINO সাপোর্ট যোগ করেছে, যার ফলে CPU-তে প্রশ্নের লেটেন্সি ৪০ মিলিসেকেন্ডে নেমেছে এবং PyTorch-এর চেয়ে ৩.৪ গুণ দ্রুত চলছে। একটি Flappy Bird ডেমোও রয়েছে।
প্রম্পট ক্যাশ টিপ. দীর্ঘ এজেন্টিক কনটেক্সটে llama.cpp-এর `-cram` ডিফল্ট ৮১৯২-এর বেশি করলে বেশি RAM লাগে, তবে প্রতি টার্নে পুরো কনটেক্সট আবার প্রসেস করা এড়ানো যায়।
১২ জিবি-তে Flash-Next. Qwen3.8-Flash-Next-এর জন্য একটি কাস্টম CUDA ইঞ্জিন ১২ জিবি RTX 5070 ও ৬৪ জিবি RAM-এ IQ3_XXS কোয়ান্ট চালিয়ে আউটপুটে সেকেন্ডে প্রায় ৬৫ টোকেন দেয়। এতে এক ক্লিকে ইনস্টল করার সুবিধা আছে।
ওপেন মডেল রিলিজ. UkisAI Swift 1.5 27B, Swift Flash Next ও Swift Bonsai 2 প্রকাশ করেছে। এগুলি প্রায় একই নির্ভুলতা রেখে থিংকিং টোকেন ৬৩.৪% পর্যন্ত কমায়। FreedomIntelligence HuatuoGPT-3-27B প্রকাশ করেছে, যা Qwen3.8-27B-র ওপর তৈরি একটি মেডিকেল LLM।
আজকের জন্য এতটুকুই - প্রায় ৫ মিনিটের পড়া।