স্থানীয় মডেল ও হার্ডওয়্যার
Qwen3.8-27B গতির উন্নতি. DFlash2 স্পেক ডিকোডিং Qwen3.8-27B-কে ডুয়াল 3090-তে 218 টোক/সেকেন্ডে, 5090-তে প্রায় 200-এ এবং অপটিমাইজড ইঞ্জিন সহ একটি 3090-তে 124-এ পৌঁছে দেয়। DFlash2 GGUF কোয়ান্ট উপলব্ধ।
পরবর্তী Qwen মাঝারি আকারের. Qwen-এর কমিউনিটি ম্যানেজার বলেছেন যে একটি নতুন মাঝারি আকারের ওপেন-ওয়েট মডেল আগামী সপ্তাহে আসবে, সম্ভবত 100B এর বেশি প্যারামিটার, কোনো প্রারম্ভিক অ্যাক্সেস ছাড়াই।
Ling-3.0 এজ সাপোর্ট. llama.cpp এখন আনুষ্ঠানিকভাবে Ling-3.0 (BailingMoE3) সমর্থন করে। ছোট ভ্যারিয়েন্টটি $249 Orin Nano 8GB-তে সম্পূর্ণ 128K কনটেক্সট চালায় 33 টোক/সেকেন্ডে, যখন Arc B580 ~114 টোক/সেকেন্ডে পৌঁছায়।
DeepSeek V4 Flash গতি. অপটিমাইজড কার্নেল এবং KV-ক্যাশ ওয়ার্মিং একটি Mac Studio M3 Ultra চ্যাট টার্নকে ৬-২০ সেকেন্ড থেকে ১.৬ সেকেন্ডে কমিয়েছে। একটি 4x RTX 3060 সেটআপ 144GiB কোয়ান্ট সহ ~100 টোক/সেকেন্ডে প্রম্পট প্রসেস করে।
লো-বিট মডেল রাউন্ডআপ. Bonsai 27B টারনারি এখন মূলধারার CUDA/Vulkan-এ কাজ করে; Mach-1 Additive 35B কনজিউমার ল্যাপটপে 120 t/s পর্যন্ত চলে। Qwen3.8-27B-এর উপর ভিত্তি করে নতুন ভ্যারিয়েন্টগুলি উন্নয়নাধীন।
এজেন্ট টুলস ও ফ্রেমওয়ার্ক
টিউনড এজেন্ট মূল্যায়নকারী. LangChain টিউনড ইভালুয়েটর চালু করেছে যা স্বয়ংক্রিয়ভাবে প্রোডাকশন ট্রেসে পার্সিভড এরর ফিডব্যাক সংযুক্ত করে। এটি একটি বিশেষায়িত মডেল ব্যবহার করে, মূল্যায়ন খরচ ৮২% পর্যন্ত কমিয়ে দেয়।
এজেন্ট সার্চ বেঞ্চমার্ক. Artificial Analysis-এর Search Index এজেন্টদের জন্য মান, খরচ এবং গতির ভিত্তিতে Parallel, Exa, Firecrawl এবং অন্যদের র্যাঙ্ক করে। ভাল সার্চ মান টোকেন ব্যবহার ৪০% এর বেশি কমিয়েছে।
MCP-এর জন্য WriteGuard. Cloudflare-এর WriteGuard, এখন প্রাইভেট বিটাতে, MCP সার্ভারের মাধ্যমে লেখার কার্যক্রমের জন্য কেন্দ্রীভূত নীতি, অ্যাট্রিবিউশন এবং অডিট লগ যুক্ত করে।
Warp সফটওয়্যার ফ্যাক্টরি. Warp Factories একটি ইনফ্রাস্ট্রাকচার স্তর যা ছোট কোম্পানিগুলিকে সফটওয়্যার ফ্যাক্টরি মডেল ব্যবহার করে AI কোডিং এজেন্ট স্থাপনে সহায়তা করে।
Claude Code মকআপ. Claude Code-এ Anthropic-এর /design কমান্ড টার্মিনালে UI মকআপ তৈরি করে, যা উন্নয়নের আগে বিদ্যমান কোডবেস স্টাইলের সাথে মেলে।
নিরাপত্তা, সুরক্ষা ও নীতি
OpenAI নিরাপত্তা সংস্কার. Hugging Face ঘটনা এবং প্রমাণ যে Astra গুরুত্বপূর্ণ সাইবারসিকিউরিটি ক্ষমতায় পৌঁছাতে পারে, তার পরিপ্রেক্ষিতে OpenAI দুই সপ্তাহের জন্য RL স্থগিত করেছে এবং স্যান্ডবক্স শক্তিশালী করেছে। এর সবচেয়ে বড় পরিকল্পিত ফ্রন্টিয়ার RL চালনা এখনও স্থগিত রয়েছে।
Copilot গার্ডরেল প্রকাশ করেছে. গবেষকরা Microsoft 365 Copilot-কে তার নিজস্ব ব্যবহারকারী-নিশ্চিতকরণ গার্ডরেল ব্যাখ্যা করতে বলেছিলেন, তারপর নিশ্চিতকরণ ছাড়াই ডেটা অপসারণের জন্য একটি লিংক-ক্লিক এক্সপ্লয়ট তৈরি করেছিলেন।
কিশোরদের জন্য ChatGPT. কিশোরদের জন্য ChatGPT ১৮ বছরের নিচের ব্যবহারকারীদের জন্য স্বয়ংক্রিয়ভাবে প্রযোজ্য হয়, কঠোর কনটেন্ট বিধিনিষেধ, স্টাডি মোড এবং প্যারেন্টাল নিয়ন্ত্রণ সহ। এটি প্রতারণা এবং ক্ষতিকারক কনটেন্ট কমাতে লক্ষ্য রাখে।
Amodei ওপেন-মডেল বিতর্ক. Anthropic-এর CEO Dario Amodei যুক্তি দেন যে ওপেন মডেল চিপ মালিকদের কাছে ক্ষমতা স্থানান্তর করে এবং AI নিয়ন্ত্রণ প্রস্তাবগুলিকে রক্ষা করেন। LeCun এবং Sacks সহ সমালোচকরা তাকে ভয় দেখানোর অভিযোগ করেন।
শিল্প ও ব্যবসা
Cursor Origin চালু করেছে. Cursor Origin চালু করেছে, কোড হোস্টিংয়ের জন্য একটি GitHub প্রতিদ্বন্দ্বী, যা এজেন্ট-নেটিভ বৈশিষ্ট্য এবং একটি অ্যাপ ইকোসিস্টেম পরিকল্পনা সহ।
Etched-এর মূল্যায়ন দ্বিগুণ. Jane Street এর প্রিফিল/ডিকোড ইনফারেন্স চিপ পরীক্ষা করার পরে Etched $21B মূল্যায়নে $700M সংগ্রহ করেছে, এক মাসে দ্বিগুণ হয়েছে।
মডেল রাউটিং চাহিদা. Stripe-এর $7B OpenRouter ক্রয় এবং Glean-এর $300M ARR ওপেন-ওয়েট মডেলগুলির জনপ্রিয়তা বৃদ্ধির সাথে মডেল রাউটিংয়ের ক্রমবর্ধমান চাহিদা তুলে ধরে।
গবেষণা ও সমীক্ষা
এজেন্ট মেমরি ক্যালিব্রেশন. Hugging Face গবেষণা দেখায় যে এজেন্টিক মেমরি প্রভাব মডেল স্তর অনুযায়ী পরিবর্তিত হয়: gpt-oss-120b সম্পূর্ণ নির্দেশিকাসহ +16.1pp টাস্ক সমাপ্তি অর্জন করেছে, যখন দুর্বল মডেলগুলির কমপ্যাক্ট পুনরুদ্ধার প্রয়োজন।
স্বাধীন AI ব্যবহারের তথ্য. Stanford-এর AI Observatory বাস্তব কথোপকথন একত্রিত করেছে এবং দেখেছে যে AI ব্যবহার মডেলগুলির মধ্যে উল্লেখযোগ্যভাবে আলাদা, কাজের ব্যবহারের ক্ষেত্রগুলি কোম্পানিগুলির দাবির চেয়ে কম সাধারণ।
কমপ্যাকশন নির্দেশনা হারায়. Penn State গবেষকরা দেখেছেন যে সেশন সীমাবদ্ধতার মাত্র ১৭% কনটেক্সট কমপ্যাকশন থেকে বেঁচে থাকে; একটি ছোট অ্যাড-অন LLM হারানো নির্দেশগুলির বেশিরভাগ পুনরুদ্ধার করে।
আত্ম-উন্নতি আসন্ন নয়. Princeton-নেতৃত্বাধীন গবেষণায় দেখা গেছে যে AI এজেন্টরা প্রকৌশল সমস্যা সমাধান করতে পারে তবে মুক্ত-প্রান্ত AI গবেষণার জন্য বিচারবুদ্ধির অভাব রয়েছে, যা প্রস্তাব করে যে পুনরাবৃত্তিমূলক আত্ম-উন্নতি আরও বেশি সময় নিতে পারে।
আজকের জন্য এতটুকুই - প্রায় ৫ মিনিটের পড়া।