মডেল প্রকাশ
Qwen 3.8 27B. আলিবাবার কিউয়েন টিম অ্যাপাচি ২.০-এর অধীনে Qwen3.8-27B এবং বৃহত্তর Qwen3.8-2.4T-A95B প্রকাশ করেছে। 27B ডেন্স মডেলটির স্থাপত্য Qwen3.6-27B-এর মতোই, কিন্তু প্রশিক্ষণ পরিবর্তনের মাধ্যমে কোডিং, অফিস কাজ এবং এজেন্ট পরিকল্পনায় উন্নতি করেছে। এটি 262k নেটিভ কনটেক্সট সমর্থন করে, যা 1M টোকেন পর্যন্ত সম্প্রসারণযোগ্য।
Zhipu থেকে GLM-5.3. Zhipu AI GLM-5.3 প্রকাশ করেছে, যেটি GLM-5.2-এর মতো একই বেস মডেল ব্যবহার করে তবে প্রশিক্ষণ-পরবর্তী সম্প্রসারণ করা হয়েছে। কোম্পানিটি দাবি করেছে এটি সবচেয়ে শক্তিশালী ওপেন-ওয়েট কোডিং মডেল, যেখানে এজেন্টিক কোডিং এবং সাইবার নিরাপত্তা দুর্বলতা আবিষ্কারে উল্লেখযোগ্য অগ্রগতি রয়েছে। ওয়েট দুই সপ্তাহের মধ্যে Hugging Face-এ প্রকাশিত হবে বলে আশা করা হচ্ছে।
Meta-এর Muse Glimmer. Meta অ্যাপাচি ২.০-এর অধীনে Muse Glimmer ওপেন-সোর্স করেছে, যা ভোক্তা GPU-তে স্থানীয় ওয়ার্কফ্লো-র জন্য তৈরি একটি 30B এজেন্টিক মডেল। এটি বৃহত্তর Muse Spark থেকে যুক্তি এবং টুল-কল দক্ষতা ডিস্টিল করে এবং সাময়িকভাবে 30B শ্রেণিতে ফ্রন্টিয়ার ছিল।
চীনা ওপেন মডেল তরঙ্গ. এক মাসেরও কম সময়ে, চীনা ল্যাবগুলি Kimi K3, Qwen3.8, DeepSeek-V4-Pro-0813 এবং GLM-5.3 প্রকাশ করেছে, যা দ্রুত ওপেন-ওয়েট ফ্রন্টিয়ার অগ্রগতি নির্দেশ করে।
স্থানীয় ডিপ্লয়মেন্ট ও কমিউনিটি
Apple Silicon-এর গতি বৃদ্ধি. নতুন mlx-dspark রিলিজ Apple Silicon-এ Qwen3.8-27B-তে স্পেকুলেটিভ ডিকোডিং নিয়ে এসেছে, যা M4 Pro-তে সর্বোচ্চ প্রায় ৩× দ্রুত জেনারেশন অর্জন করে, একই আউটপুট টোকেন তৈরি করে।
কোয়ান্টাইজেশন ও ওয়েট. Unsloth Qwen3.8-27B-এর কোয়ান্টাইজড ওয়েট প্রকাশ করেছে, এবং Tim Dettmers একটি নতুন কোয়ান্টাইজেশন পদ্ধতির ইঙ্গিত দিয়েছেন যা একটি একক DGX Spark-এ GLM-5.3 চালাতে পারে প্রতি সেকেন্ডে ৭ টোকেন গতিতে।
প্রাথমিক Qwen 3.8 পরীক্ষা. কমিউনিটি পরীক্ষাগুলি Qwen3.8-27B-তে শক্তিশালী ওয়ান-শট কোডিং ডেমো এবং এজেন্টিক আচরণ দেখায়, তবে কিছু ব্যবহারকারী xhigh রিজনিং এফোর্টে লক্ষণীয়ভাবে ছাঁটাই করা সাধারণ জ্ঞান এবং অত্যন্ত দীর্ঘ চিন্তার ট্রেসের কথা জানিয়েছেন। প্রস্তাবিত স্যাম্পলিং প্যারামিটার মডেল কার্ডে উপলব্ধ।
- → Qwen 3.8 - 27B is a game changer
- → A hunch: Qwen3.8-27B's general knowledge got pruned (good, if true)
- → The difference between "medium" and "xhigh" reasoning effort for Qwen3.8-27B is actually insane.
- → Qwen 3.8 27B - Aquarium Burst Sample Test
- → RetroCraft - Qwen 3.8 27B Q8, one shot with exact performance data on dual 3090s.
সেন্সরহীন স্থানীয় ভ্যারিয়েন্ট. Qwen3.8-27B-এর একটি কমিউনিটি 'হেরেটিক' সংস্করণ প্রত্যাখ্যান এবং সুরক্ষা ব্যবস্থা সরিয়ে দেয়, যার লক্ষ্য Opus 4.6-এর মতো একটি ফ্রন্টিয়ার মডেলের স্তরে একটি স্থানীয় সেন্সরহীন বিকল্প প্রদান করা।
এআই স্বচ্ছতা ও নিরাপত্তা
Anthropic-এর ওয়াটারমার্ক সনাক্তকরণ. Anthropic একটি ওয়াটারমার্ক সনাক্তকরণ API অফার করবে, যাতে তৃতীয়-পক্ষের ডেভেলপাররা Claude দ্বারা তৈরি হওয়ার সম্ভাবনা রয়েছে এমন টেক্সট সনাক্ত করতে পারে। পদ্ধতিটি SynthID Text ব্যবহার করে এবং ছোট, তথ্যবহুল বা ব্যাপকভাবে পুনর্লিখিত টেক্সটে কম নির্ভরযোগ্য।
Google ওয়াটারমার্ক ঐচ্ছিক করছে. Google ব্যবহারকারীদের Nano Banana, Omni এবং Lyria থেকে AI-জেনারেটেড ছবি, ভিডিও এবং সঙ্গীতে দৃশ্যমান ওয়াটারমার্ক বন্ধ করার অনুমতি দিচ্ছে। যাচাইয়ের জন্য অদৃশ্য SynthID এবং C2PA মেটাডেটা এখনও এমবেড করা থাকবে।
আদালতে প্রম্পট ইনজেকশন. কানেকটিকাটের একজন বিচারক নথিভুক্ত করেছেন যা মার্কিন আদালতে প্রথম দাখিলা বলে মনে হচ্ছে, যেখানে মামলা পর্যালোচনাকারী AI সিস্টেমকে কারসাজি করার জন্য লুকানো টেক্সট রয়েছে। লুকানো নির্দেশাবলীর কোনো প্রভাব পড়েনি, তবে বিচারক কৌশলটিকে বিপজ্জনক বলেছেন।
প্রোডাকশনে এজেন্ট
Claude Code রক্ষণাবেক্ষণ কার্য. Anthropic জানিয়েছে, Claude Code তার নিজস্ব অ্যাপগুলিতে প্রতিদিনের রক্ষণাবেক্ষণ চালাচ্ছে, মানব পর্যালোচনার পরে ৪৬ শতাংশ মার্জ হারসহ ৩৮৮টি পুল রিকোয়েস্ট তৈরি করেছে। রুটিনগুলির মধ্যে রয়েছে ক্র্যাশ ফাজিং, ডুপ্লিকেট অ্যাবস্ট্রাকশন ক্লিনআপ এবং ডিপেন্ডেন্সি চেক।
OpenAI Computer History. OpenAI-এর কম্পিউটার হিস্টোরি Chronicle স্ক্রিনশট প্রোটোটাইপ প্রতিস্থাপন করে, যা macOS-এ ক্লিক, কীস্ট্রোক এবং অ্যাপ সুইচ রেকর্ড করে একটি অনুসন্ধানযোগ্য টাইমলাইন তৈরি করে। এটি পুনরাবৃত্তিমূলক ওয়ার্কফ্লো সনাক্ত করতে পারে এবং ChatGPT ও Codex-এর জন্য পুনঃব্যবহারযোগ্য দক্ষতা সুপারিশ করতে পারে।
শিল্প ও ব্যবসা
মার্কিন-চীন দাম যুদ্ধ. OpenAI এবং Anthropic দাম কমাচ্ছে কারণ চীনা ওপেন মডেল জনপ্রিয়তা পাচ্ছে; Google-এর Gemini 3.7 Flash কোডিং এবং এজেন্ট-এর লক্ষ্যে ৫০ শতাংশ প্রারম্ভিক মূল্য ছাড় দিয়ে আত্মপ্রকাশ করেছে। জুলাইয়ের মাঝামাঝি থেকে মার্কিন শীর্ষ ল্যাবগুলির টোকেন মূল্য প্রায় এক-চতুর্থাংশ কমেছে।
GPT-5.6 Sol Ultrafast. OpenAI Cerebras-চালিত GPT-5.6 Sol-এর জন্য Ultrafast মোডের একটি প্রিভিউ চালু করেছে, যা প্রতি সেকেন্ডে সর্বোচ্চ ৭৫০ আউটপুট টোকেন সরবরাহ করে। API পরিষেবাটি প্রাথমিকভাবে নির্বাচিত গ্রাহকদের মধ্যে সীমাবদ্ধ এবং ঘটনা বা বাজার ইভেন্টের সময় রিয়েল-টাইম বিশ্লেষণের লক্ষ্যে তৈরি।
Meta-এর সবার জন্য AI. Meta Glimmer প্রকাশের সাথে একটি দীর্ঘ Zuckerberg চিঠি যুক্ত করেছে, যেখানে যুক্তি দেওয়া হয়েছে যে AI সবার জন্য উন্মুক্ত হওয়া উচিত, তবে পডকাস্ট কভারেজ নোট করে যে কোম্পানি তার সবচেয়ে শক্তিশালী Muse Spark API-এর পিছনে রেখেছে। একই আলোচনায় $250 মিলিয়ন ডলারের একটি অধিগ্রহণ ভুল হয়েছে বলে উল্লেখ করা হয়েছে।
Apple-Alibaba China মডেল. Apple খবর অনুযায়ী, Alibaba-এর সহায়তায় চীনের বাজারের জন্য একটি কাস্টম AI মডেল প্রশিক্ষণ দিয়েছে, চীনা ডিভাইসে Apple Intelligence আনার আগে। এই অংশীদারিত্ব একটি বিরল US-China AI সহযোগিতা।
Kog ইনফারেন্স উদ্যোগ. ফরাসি স্টার্টআপ Kog সফ্টওয়্যার অপ্টিমাইজেশন ব্যবহার করে প্রচলিত GPU-গুলির (যেমন AMD MI300X এবং Nvidia H200) থেকে আরও গতি বের করছে, যার লক্ষ্য সফ্টওয়্যার ইঞ্জিনিয়ারিং ওয়ার্কলোডের জন্য দ্রুততর একক-রিকোয়েস্ট ডিকোডিং।
প্রাকৃতিক গ্যাসের দাম ঝুঁকি. নতুন Noreva পূর্বাভাস সতর্ক করেছে যে মার্কিন যুক্তরাষ্ট্রের কিছু অংশে প্রাকৃতিক গ্যাসের দাম তিনগুণ হতে পারে, কারণ Amazon, Google, Meta এবং Microsoft-এর মতো হাইপারস্কেলাররা AI ডেটা সেন্টারের জন্য গ্যাস বিদ্যুৎ নিশ্চিত করছে।
গবেষণা হাইলাইটস
150M ARC মডেল. একটি 150M-প্যারামিটার রিকারেন্ট লেটেন্ট রিজনিং মডেল প্রতি টাস্কে $0.0007 খরচে ARC-AGI-1-এ 29.5% স্কোর করেছে, যা প্রকাশিত খরচ-নির্ভুলতা ফ্রন্টিয়ারের বাইরে। এটি ন্যূনতম হার্ডওয়্যারে চলে, তবে বিলিয়ন প্যারামিটারে স্কেল করা এখনও প্রয়োজন।
স্বায়ত্তশাসিত গবেষণা নিয়ে সন্দেহ. প্রিন্সটন এবং UK AISI-এর একটি গবেষণা অপ্রকাশিত NeurIPS পেপার ব্যবহার করে দেখেছে যে বর্তমান ফ্রন্টিয়ার মডেলগুলি গবেষণা ইঞ্জিনিয়ারিং পরিচালনা করতে পারে, তবে গবেষণার গুরুত্বপূর্ণ অংশগুলিতে ব্যর্থ হয়, যা স্বায়ত্তশাসিত AI গবেষণা সম্পর্কে ল্যাবের দাবির বিপরীত।
DarwinX হারনেস বিবর্তন. DarwinX প্রম্পট, টুল, দক্ষতা এবং কন্ট্রোল ফ্লো-এর উপর প্রাকৃতিক নির্বাচনের মাধ্যমে এজেন্ট হারনেস বিবর্তিত করে, মডেল ওয়েট হিমায়িত রেখে। এটি চারটি বেঞ্চমার্কে গড়ে প্রায় ১৭ পয়েন্ট যোগ করে এবং SWE-bench Verified-এ অপরিবর্তিত স্থানান্তরিত হয়।
PlayWorld বেঞ্চমার্ক. PlayWorld ভিডিও ওয়ার্ল্ড মডেল বেঞ্চমার্ক করতে মাল্টিমোডাল এজেন্ট প্লেয়ার ব্যবহার করে, যারা ১৭১টি দীর্ঘ-দিগন্ত লক্ষ্য অনুসরণ করে, জ্যামিতি সামঞ্জস্য, ইন্টারঅ্যাকশন বিশ্বস্ততা, দৃষ্টির বাইরে বিবর্তন এবং অন্তর্দৃষ্টি বিবর্তন পরিমাপ করে।
আজকের জন্য এতটুকুই - প্রায় ৫ মিনিটের পড়া।