Agentic AI News আজ

দিনের এআই এজেন্ট সংবাদ এক ৫ মিনিটের পঠনে: রিলিজ, টুলস, গবেষণা, ফান্ডিং এবং এন্টারপ্রাইজ মুভস।

প্রতিদিন আপডেট 30টি উৎস থেকে সংগৃহীত রবিবার, আগস্ট 30, 2026

এজেন্ট ও মডেল রিলিজ

টেনসেন্ট Hy4 প্রিভিউ. টেনসেন্ট Hy4 প্রিভিউ প্রকাশ করেছে, যা Hy3-এর তুলনায় আকারে অনেক বড়, ডিফল্ট হাই রিজনিং এবং no_think মোডসহ। কমিউনিটিতে ইতিমধ্যে একটি প্রায় ২.৩৮-বিট অফিশিয়াল কোয়ান্ট এবং একটি প্রায় ২০০ গিগাবাইট GGUF আছে, যা জানা গেছে BF16 পারফরম্যান্সের প্রায় ৯৮% ধরে রাখে।

লোকাল ইনফারেন্স ও হার্ডওয়্যার

FlashMLA sm_120 পোর্ট. একটি কমিউনিটি বিল্ড FlashMLA-কে কনজিউমার Blackwell sm_120 GPU-তে পোর্ট করেছে, যার ফলে বেশ কয়েকটি স্পার্স MLA ওয়ার্কলোডে PyTorch SDPA-র তুলনায় ২–৩ গুণ গতি বৃদ্ধি এবং FP8 KV ক্যাশ ডিকোডে ৮% কম লেটেন্সি দেখা গেছে।

Nemotron ১৬ জিবি ফিক্স. Nemotron-3.5-Lightning-এর লো-বিট GGUF-গুলো নিঃশব্দে প্রায় ৪.৭০ bpw ছিল, কারণ রো-প্রস্থ কোয়ান্টাইজেশন; একটি প্যাচ করা llama.cpp বিল্ড এখন সত্যিকারের ৩.০৭ bpw / ১১.৭৭ গিবি ফাইল তৈরি করে, যা ১৬ জিবি মেমরিতে ২৬২ হাজার কনটেক্সট চালায়।

Mac-এ Qwen3.8-Flash-Next. একটি ৭৯ জিবি ২-বিট Qwen3.8-Flash-Next, llama.cpp ব্যবহার করে ১২৮ জিবি M5 Max-এ ৩৫০ হাজার টোকেন কনটেক্সট স্লটে চালানো হয়েছে। এর মধ্যে ছিল ১০৫ হাজার টোকেন প্রম্পটের ৩৩৩ সেকেন্ডের কোল্ড প্রিফিল এবং ngram-mod স্পেকুলেটিভ ডিকোডিং।

DeepSeek V4 Flash দুই GPU-তে. ২টি DGX Spark/GX10 সেটআপে DeepSeek V4 Flash 0731 ধারাবাহিকভাবে ৬৭–৮৪ টোকেন/সেকেন্ড গতিতে পৌঁছায়, যেখানে লোকাল HumanEval Pass@1 ৯৪.৫%, এবং GLM-5.3-Flash NVFP4-এর ৯৭.০%। GLM বেঞ্চমার্কটি প্রায় অর্ধেক সময়ে শেষ করেছে।

দুটি 5090-তে ১M কনটেক্সট. একটি NInfer ফর্ক টেনসর প্যারালালিজম এবং YaRN ×৪ স্কেলিং যোগ করেছে, যাতে দুটি 5090-তে Qwen3.8-27B NVFP4 ১০,৪৮,৫৭৬-টোকেন কনটেক্সটসহ চালানো যায়, ১M-এ ৪৮–১০০ টোকেন/সেকেন্ড ডিকোড করে এবং vLLM যেখানে শূন্যে নেমে যায়, সেখানে MTP অ্যাকসেপ্ট্যান্স বজায় রাখে।

১৬ জিবিতে ২৭B. হাইব্রিড কোয়ান্টাইজেশন এবং kvarn ক্যাশ সেটিংসের মাধ্যমে Qwen3.8-27B ১৬ জিবি RTX 4070 Ti SUPER-এ ১০০ হাজার কনটেক্সটসহ ৫০ টোকেন/সেকেন্ডে চালানো সম্ভব হয়েছে, MTP স্পেকুলেটিভ ডিকোডিং এবং টেইল-প্রিসিশন KV ক্যাশ ব্যবহার করে।

FreeToken MoE ইঞ্জিন. UC Berkeley এবং MIT-এর গবেষকরা FreeToken চালু করেছেন, এটি একটি ওপেন-সোর্স ইঞ্জিন যা MoE এক্সপার্ট ট্রান্সফারগুলো গতিশীলভাবে সমন্বয় করে, যাতে ফ্রন্টিয়ার স্পার্স মডেলগুলো PCIe/RAM মিসের কারণে থেমে না গিয়ে কনজিউমার GPU-তে ডিকোড করতে পারে।

বেঞ্চমার্ক ও মূল্যায়ন

Terminal Bench 4.0. Terminal Bench 4.0 প্রকাশিত হয়েছে, যার সঙ্গে হালনাগাদ লিডারবোর্ড এবং স্যাচুরেশন মোকাবিলায় দ্রুত পুনরাবৃত্তির উপর জোর দেওয়া হয়েছে; GLM-5.3-এর স্কোর Fable 5-এর সমতুল্য, যা পরিসংখ্যানগত ত্রুটির সীমার মধ্যে।

ফাইন্যান্স বেঞ্চমার্ক প্রকাশ. Ling-3.0-flash-Fin-এর জন্য একটি বেঞ্চমার্ক কার্ড দেখায় যে এজেন্ট স্ক্যাফোল্ডিং, টুলস এবং ইভ্যালুয়েশন পাইপলাইনগুলো রিপোর্ট করা ফলাফলকে কতটা প্রভাবিত করে; অনেক রানে ওয়েব সার্চ ও Python-সহ ReAct ব্যবহার করা হয়েছে, এবং কিছু ইভাল সেট অভ্যন্তরীণ বা এখনও প্রকাশিত হয়নি।

গবেষণা ও এজেন্ট ইনফ্রাস্ট্রাকচার

Google-এর WikiSkill মেমোরি. Google Research-এর WikiSkill এজেন্টদের অতীত ব্যর্থতা ও সাফল্যের একটি স্থায়ী উইকি-সদৃশ জ্ঞানভান্ডার দেয় এবং পুনর্ব্যবহারযোগ্য Agent Skills প্যাকেজ করে, যা মডেল ওয়েট না বদলে আচরণ পরিচালনা করে।

Anthropic মডেল হার্ডওয়্যার স্ট্যান্ডার্ড. Anthropic MHS তৈরি করছে, এটি একটি ইউনিফাইড ইন্টারফেস যা এজেন্টদের মাইক্রোস্কোপ ও রোবোটিক আর্মের মতো ফিজিক্যাল ডিভাইস নিয়ন্ত্রণের সুযোগ দেবে; প্রাথমিক পরীক্ষায় মাল্টি-মেশিন ইন্টিগ্রেশন সপ্তাহ থেকে ঘণ্টায় নেমে এসেছে, তবে মানব তত্ত্বাবধান এখনও প্রয়োজনীয়।

এজেন্টদের জন্য ডেটা লেয়ার. TOTVS-এর একটি উপস্থাপনায় যুক্তি দেওয়া হয়েছে যে ট্রানজেকশনাল সিস্টেম ও ডেটা লেক প্রচুর টোকেন খরচ করে এমন এবং লেটেন্সি-সংবেদনশীল এজেন্ট রিজনিংয়ের জন্য অপ্টিমাইজড নয়, এবং MCP ও সেম্যান্টিক মডেলের দিকে ডেটা অ্যাক্সেসের বিবর্তনের কথা বর্ণনা করা হয়েছে।

LAION Big Video Dataset. LAION BVD প্রকাশ করেছে, এটি একটি শুধু গবেষণার জন্য ডেটাসেট—১০ মিলিয়ন ঘণ্টার ভিডিও, ৫৫ মিলিয়ন ক্লিপ এবং ৩০০ মিলিয়ন স্থির চিত্র, যা ভিডিও, অডিও ও টেক্সটকে একসঙ্গে যুক্ত করে; এতে প্রশিক্ষিত মডেলগুলো কিছু বেঞ্চমার্কে InternVid বেসলাইনের চেয়ে ২.১ পয়েন্ট পর্যন্ত ভালো করেছে।

শিল্প ও ব্যবসা

Anthropic-এর বিরুদ্ধে Sony-Warner মামলা. Sony Music Publishing, Warner Chappell এবং অন্যান্য প্রকাশকরা Anthropic-এর বিরুদ্ধে মামলা করেছে, অভিযোগ করে যে কপিরাইটযুক্ত কাজ টরেন্টিং ও স্ক্র্যাপিং করে Claude-কে প্রশিক্ষণ দেওয়া হয়েছে, এবং প্রতিটি কাজের জন্য ১,৫০,০০০ ডলার পর্যন্ত ক্ষতিপূরণ চাওয়া হয়েছে। Anthropic বলেছে, তারা নিজেদের রক্ষা করবে।

Cursor-এর সঙ্গে OpenAI-র সম্পর্কচ্ছেদ. SpaceX Cursor অধিগ্রহণ করার পর OpenAI Cursor-এর সঙ্গে চুক্তি শেষ করছে, এলন মাস্কের কোম্পানিগুলোর চুক্তি ভাঙার ইতিহাসের কথা উল্লেখ করে। এর জবাবে Anthropic নিজেকে আরও নির্ভরযোগ্য অংশীদার হিসেবে উপস্থাপন করেছে এবং Cursor-এর Claude ব্যবহারের জন্য অব্যাহত কম্পিউট সরবরাহের প্রতিশ্রুতি দিয়েছে।

GPU-র বাইরে Nvidia. Nvidia-র আয়ের ন্যারেটিভ এখন GPU শেয়ারের বদলে ডেটাসেন্টার অর্কেস্ট্রেশন এবং GPU-কেন্দ্রিক সিস্টেমগুলোর দিকে সরে যাচ্ছে, যেখানে AI কম্পিউট গিগাওয়াটে পৌঁছানোর সঙ্গে সঙ্গে কোম্পানিটি অত্যাধুনিক নেটওয়ার্কিং ও অর্কেস্ট্রেশন হার্ডওয়্যার তৈরি করেছে।

আজকের জন্য এতটুকুই - প্রায় ৫ মিনিটের পড়া।

প্রতি সকালে আপনার ব্রাউজারে পড়ুন

এক্সটেনশনটি এই ডাইজেস্টটি Chrome-এর সাইড প্যানেলে খোলে — এক ক্লিক, কোনো অ্যাকাউন্টের প্রয়োজন নেই।

ক্রোমে যোগ করুন — বিনামূল্যে