এজেন্ট ও মডেল রিলিজ
Claude Fable 5.1. Anthropic Fable 5.1 এবং Mythos 5.1 প্রকাশ করেছে। কোম্পানির দাবি, কোডিং ও গবেষণায় এগুলো ভালো পারফরম্যান্স দেবে এবং সস্তা ক্যাশ রিডের কারণে এজেন্টিক কাজের খরচ 45% পর্যন্ত কমবে। সীমাবদ্ধতা ছাড়াই Fable 5.1 এখন পাওয়া যাচ্ছে; তবে রিজনিং ইফোর্ট সবচেয়ে বেশি রাখলে এই সর্বোচ্চ সাশ্রয় মিলবে কি না, প্রাথমিক খরচ বিশ্লেষণে তা নিয়ে প্রশ্ন উঠেছে।
- → Claude Fable 5.1 made me a really nice animated pelican
- → Anthropic launches Claude Fable 5.1 and says it’s up to 45 percent cheaper for agentic work
- → Anthropic's Claude Fable 5.1 promises better coding and research at up to 45 percent less
- → Anthropic’s new Fable release is cheaper, less restrictive
OpenAI Astra-র রোলআউট. OpenAI বলছে, আসন্ন Astra মডেলটিই প্রথম LLM, যা প্রতিষ্ঠানের গুরুত্বপূর্ণ সাইবার নিরাপত্তার মান পূরণ করেছে—অজানা দুর্বলতা নিজে খুঁজে বের করে কাজে লাগাতে পারে। Hugging Face-এ হ্যাকের পর Astra-র উন্নয়নের কিছু অংশ পিছিয়ে দেওয়া হয়েছে, নিরাপত্তা ব্যবস্থা আরও শক্তিশালী করতে। সবচেয়ে উন্নত সাইবার নিরাপত্তা ক্ষমতাগুলোর অ্যাক্সেসও সীমিত রাখা হবে।
নতুন Spark-X2.5 মডেল. ওপেন মডেল Spark-X2.5-4B ও 1.7B নতুন আর্কিটেকচার নিয়ে Hugging Face-এ এসেছে। দাবি, এদের পারফরম্যান্স Qwen 3.5 9B-এর কাছাকাছি এবং নেটিভ 1M কনটেক্সট সাপোর্ট আছে। মূলধারার llama.cpp-এ এরা এখনো চলে না, তবে কাস্টম ফর্ক আছে।
Runway Solaris ইন্টারফেস মডেল. Runway Solaris নামে একটি “ইন্টারফেস ওয়ার্ল্ড মডেল” উন্মোচন করেছে, যা কোড চালানোর বদলে রিয়েল টাইমে UI ফ্রেম তৈরি করে এবং ক্লিক বা ভয়েস কমান্ডে সাড়া দেয়। এটি এখনো গবেষণা পর্যায়ের; টেক্সট রেন্ডারিং আর স্ক্রিন রিডার সাপোর্টে সীমাবদ্ধতা আছে।
লোকাল AI ও হার্ডওয়্যার
Qwen3.8 লোকাল রিপোর্ট. কমিউনিটি রিপোর্টে দেখা যাচ্ছে, Qwen3.8 27B ও Flash-Next নানা হার্ডওয়্যারে চলছে: 48GB Mac-এ 12 tok/s, দুটি Epyc R9700-তে MXFP4 কার্নেলসহ ডিকোড গতি 280 tok/s এবং কাস্টম অপটিমাইজেশনের পর একটি RTX 3090-তে ডিকোড গতি 132 tok/s। কোয়ান্ট বেঞ্চমার্কে UD Q3_K_XL 16GB কার্ডের জন্য ভালো মানানসই। তবে কয়েকজন ইউজারের মতে Qwen3.8 ভালো কোডার, কিন্তু কোড বদলাতে বাড়াবাড়ি করে।
- → Running 104GB Qwen3.8-Flash-Next on 48GB Mac at ~12 tok/s
- → How I got 280 tok/s on Qwen3.8 27B on 2xr9700's and 940k tokens kv cache
- → I pushed Qwen3.8-27B to 2.000 prefill per second and 132 decode per second on A RTX 3090.
- → Kaitchup posted Qwen3.8 27B Benchmarks for quants from Q4 to Q1
- → Everyone is t/s maxing.. 3.8.. but after a week of using it for work I'm tempted to switch back to 3.6
DGX Spark-এর দাম বৃদ্ধি. Nvidia DGX Spark ও Asus Ascent GX10-এর দাম উল্লেখযোগ্য হারে বেড়েছে; Asus মডেলটির দাম $3,999 থেকে লাফিয়ে $5,999 হয়েছে। বেশি মেমরি ব্যান্ডউইথ দেওয়া AMD Epyc সিস্টেমের তুলনায় DGX Spark-এর ক্লাস্টার কি সত্যিই সাশ্রয়ী, সেটাই এখন ভাবছেন ক্রেতারা। তবে DGX-এ FP4 সাপোর্ট ও টেনসর প্যারালালিজম আছে।
CMP 170HX নষ্ট হওয়ার রিপোর্ট. একজন ইউজার জানিয়েছেন, পাঁচটি CMP 170HX GPU-র মধ্যে দুটি দুই সপ্তাহের মধ্যে নষ্ট হয়েছে; তৃতীয়টিতে টেনসর কোর ত্রুটিপূর্ণ। ওই ইউজারের মতে, LLM ইনফারেন্সের জন্য বর্তমান দামে এ ধরনের ঝুঁকি নেওয়ার মানে নেই।
INT8 ও ভুল কোয়ান্ট লেবেল. RTX 3090-তে নেটিভ INT8 টেনসর কোর থাকা সত্ত্বেও INT8 W8A8 মডেলগুলো বেশি ব্যবহৃত হয় না কেন—কমিউনিটিতে এই প্রশ্ন উঠেছে। অন্যদিকে, একজন ইউজার AtomicChat-এর বিরুদ্ধে অভিযোগ এনেছেন যে IQ2_S কোয়ান্টকে Q4_K_M হিসেবে ভুল লেবেল দেখানো হচ্ছে।
Intel-এর মেমরি উচ্চাকাঙ্ক্ষা. Intel মেমরি ব্যবসায় ফেরার ইঙ্গিত দিয়েছে। প্রতিষ্ঠানের সিইও SK Hynix-এর সাবেক নির্বাহী Seok-Hee Lee-কে নিয়োগ এবং নতুন মেমরি আর্কিটেকচারের কথাও বলেছেন; তবে বিস্তারিত তথ্য এখনো নেই।
টুলস ও ফ্রেমওয়ার্ক
OpenClaw 2.0 রিলিজ. OpenClaw 2.0 রিলিজ হয়েছে। ওপেন সোর্স এই ব্যক্তিগত AI এজেন্টের সেটআপ এখন সহজ: এটি আগে থেকে থাকা ChatGPT/Claude সাবস্ক্রিপশন ও লোকাল মডেল নিজে শনাক্ত করে এবং ব্রাউজারকেই প্রাথমিক ইন্টারফেস হিসেবে নতুন করে সাজিয়েছে। এর সঙ্গে সহযোগিতার জন্য শেয়ার্ড ক্লাউড সেশনও যোগ হয়েছে।
Codex-এ লোকাল টুলস. OpenAI-র Codex ডেস্কটপ অ্যাপের রানটাইমে এখন সম্পূর্ণ LibreOffice-এর ইনস্টলেশন এবং Poppler, git-এর মতো বাইনারিও আছে। ফলে বাইরের কোনো নির্ভরতা ছাড়াই ডকুমেন্ট প্রসেসিং স্কিল চালানো যাবে।
AI সফটওয়্যার ফ্যাক্টরি. Flue ও tldraw-এর মতো শীর্ষ AI ওপেন সোর্স প্রজেক্টগুলো এখন বাইরের PR নিচ্ছে না; বদলে ইস্যু ট্রায়াজ, রিপ্রোডিউজ, ফিক্স ও রিভিউ—সব কাজ এজেন্টদের দল করছে। Vercel-এর AI SDK প্রজেক্টও একটি মাল্টি-এজেন্ট “সফটওয়্যার ফ্যাক্টরি” বসিয়েছে, যাতে জমে থাকা 1,000-এর বেশি issue ও 800-এর বেশি PR-এর ব্যাকলগ কমানো যায়।
এজেন্টদের জন্য Terraform. HashiCorp HCP Terraform-কে AI-চালিত ইনফ্রাস্ট্রাকচারের জন্য গভর্ন্যান্সসহ কন্ট্রোল প্লেন হিসেবে তুলে ধরছে। এতে এজেন্টরা Terraform পরিবর্তনগুলো লিখে প্রয়োগ করতে পারবে, আর পলিসি, আইডেন্টিটি ও অডিট নিয়ন্ত্রণ বলবৎ থাকবে।
datasette-mcp আপডেট. datasette-mcp প্লাগইনের 0.2 সংস্করণ প্রকাশিত হয়েছে। SQL কোয়েরির ফলাফল এখন অ্যারের বদলে অবজেক্ট হিসেবে আসে; এতে দুর্বল মডেলগুলোর জন্য কলাম সঠিকভাবে ম্যাপ করা সহজ হয়।
গবেষণা ও নিরাপত্তা
BenchMIRT বেঞ্চমার্ক অডিট. Hugging Face চালু করেছে BenchMIRT, যা LLM বেঞ্চমার্কের প্রতিটি প্রম্পট আলাদাভাবে অডিট করার একটি পদ্ধতি। এতে দেখা যাচ্ছে, একই বেঞ্চমার্কের ভিন্ন প্রম্পট ভিন্ন দক্ষতা মাপতে পারে; গড় স্কোর সেই পার্থক্য চাপা দিতে পারে।
Gemini-তে এজেন্টিক ভিডিও. Google DeepMind Gemini 3.7/3.6/3.5 Flash-Lite-তে এজেন্টিক ভিডিও আন্ডারস্ট্যান্ডিং চালু করেছে। নেটিভ ভিডিও টুল দিয়ে মডেল ভিডিও সেগমেন্ট নিজে খুঁজে দেখতে পারে; এতে বিশ্লেষণের নির্ভুলতা বাড়ে এবং টোকেন খরচ কমে।
Claude-এর টেক্সট ওয়াটারমার্কিং. Anthropic তার ওয়াটারমার্ক ভেরিফিকেশন API-র অ্যাক্সেস খুলে দিয়েছে নিয়ন্ত্রক, গণমাধ্যম ও ফ্যাক্ট-চেকারদের জন্য। অনুমোদিত প্রতিষ্ঠানগুলো Claude-এর তৈরি টেক্সট শনাক্ত করতে পারবে—একটি পরিসংখ্যানগত প্যাটার্নের মাধ্যমে, যা কিছু সম্পাদনার পরেও টিকে থাকতে পারে। EU AI Act-এর প্রয়োজনীয়তা মেনেই এই ব্যবস্থা।
নির্বাচন ও পক্ষপাত. AlgorithmWatch-এর পর্যবেক্ষণে দেখা গেছে, Google-এর নির্বাচনসংক্রান্ত AI Overviewগুলো অসামঞ্জস্যপূর্ণ, কয়েকটি সোর্সের ওপর নির্ভর করে এবং মাঝে মাঝে প্রার্থীদের পক্ষপাতমূলক ভাষায় বর্ণনা করে। আলাদা এক ঘটনায় Google-এর AI সার্চ জাতীয়তার ভিত্তিতে জরুরি নম্বরে কলের পরামর্শ দিয়েছিল; পরে ব্যবস্থা নেওয়া হয়েছে।
ইন্ডাস্ট্রি ও বিজনেস
AfterQuery-এর দ্রুত উত্থান. AI ট্রেনিং-ডেটা স্টার্টআপ AfterQuery 3.2 বিলিয়ন ডলার ভ্যালুয়েশনে ফান্ডিং তুলেছে বলে খবর। পাঁচ মাসে এই ভ্যালুয়েশন 10 গুণ বেড়ে যাওয়ায় AfterQuery এখন Y Combinator-এর দ্রুততম ইউনিকর্ন। প্রতিষ্ঠানটি পেশাদারদের নিয়োগ করে মডেলকে প্রশিক্ষণ দেয়, যেন মডেল পেশাদারদের মতো কাজ শেষ করতে শেখে।
AIR-এর 50 মিলিয়ন ডলার. AI সিকিউরিটি স্টার্টআপ AIR 50 মিলিয়ন ডলার নিয়ে স্টিলথ থেকে বেরিয়ে এসেছে। কোম্পানিগুলোকে এজেন্ট খুঁজে বের করতে এবং ব্যবহৃত স্কিল, MCP সার্ভার ও অ্যাড-অনগুলো নিয়মিত যাচাই করতে সাহায্য করবে এটি; পাশাপাশি, অননুমোদিত সফটওয়্যারের সঙ্গে ইন্টারঅ্যাকশন ব্লক করবে।
Google-এর হলিউড ডিল. খবর, Google বড় স্টুডিওগুলোর সঙ্গে লাইসেন্সিং চুক্তি করার চেষ্টা করছে, যাতে কপিরাইটযুক্ত কন্টেন্ট দিয়ে AI মডেল ট্রেনিং করা যায়; এর জন্য বড় অঙ্কের অর্থ দেওয়ার প্রস্তাবও আছে। তবে বিশ্লেষকদের মতে, এই ধরনের চুক্তি স্টুডিওগুলোর জন-ভাবমূর্তির জন্য ঝুঁকি তৈরি করতে পারে।
ফ্রন্টিয়ার AI-তে ফোকাস. Google DeepMind-এর নতুন প্রধান Koray Kavukcuoglu বলেছেন, ফ্রন্টিয়ার AI-তে নেতৃত্বই একমাত্র গুরুত্বপূর্ণ বিষয়। বর্তমান মডেলগুলো ফ্রন্টিয়ার থেকে কিছুটা পিছিয়ে আছে বলে তিনি স্বীকার করেছেন; তবে ব্যবধান ঘোচানোর অঙ্গীকার করেছেন। Gemini 4 বা 3.5 Pro নিয়ে কোনো সুনির্দিষ্ট আপডেট দেননি।
অপারেশনে AI এজেন্ট. OpenAI-র Enterprise Signals-এর তথ্য অনুযায়ী, ফ্রন্টিয়ার কোম্পানিগুলো অ্যাক্টিভ ইউজারপ্রতি 8.3 গুণ বেশি আউটপুট টোকেন তৈরি করছে। Basis, Clay ও Exa Labs-এর মতো স্টার্টআপগুলোও অনবোর্ডিং, অ্যাকাউন্ট ম্যানেজমেন্ট ও ডেভেলপার ইন্টিগ্রেশনে এজেন্ট ব্যবহার করছে।
Apple-OpenAI আইনি লড়াই. Apple OpenAI-র বিরুদ্ধে দ্রুত ডিসকভারির জন্য আদালতের অনুমতি চেয়েছে। অভিযোগ, প্রাক্তন এক Apple কর্মীর MacBook-এ ফরেনসিক ডেটা ধ্বংসের আলোচনা ছিল; OpenAI সেটি পরীক্ষা করেনি।
Google Pics ডিজাইন টুল. Google Workspace-এর জন্য Google Pics চালু করেছে। Nano Banana-চালিত এই AI টুল প্রম্পট-ভিত্তিক ডিজাইন আর নির্ভুল অবজেক্ট এডিটিং করে ছবি তৈরি ও সম্পাদনা করতে পারে। Canva এবং Adobe Express-এর সঙ্গে প্রতিযোগিতার জন্যই এই পদক্ষেপ।
কনজিউমার AI এজেন্ট. Fambot পরিবারের জন্য একটি AI চিফ অব স্টাফ চালু করেছে, যা পারিবারিক নানা কাজের সমন্বয় করবে। John Deere কৃষকদের জন্য JD AI সহকারী চালু করেছে, যা তাদের নিজস্ব ডেটা ব্যবহার করে। Amazon-এর Alexa-তে “Update Me When” শপিং অ্যালার্ট যোগ হয়েছে।
আজকের জন্য এতটুকুই - প্রায় ৫ মিনিটের পড়া।