شرکت آنتروپیک با معرفی Claude Fable 5.1 و نسخه سایبری Mythos 5.1 گامی بنیادین در بازطراحی اقتصاد ایجنتهای هوش مصنوعی برداشت. این مقاله به تحلیل فنی سقوط ۷۵ درصدی هزینه کشینگ، نتایج بنچمارک Terminal-Bench-Science و دستاوردهای میدانی میپردازد.
در نخستین روزهای سپتامبر ۲۰۲۶، شرکت آنتروپیک با رونمایی غافلگیرکننده از دو مدل پرچمدار Claude Fable 5.1 و Claude Mythos 5.1 ، رسماً پارادایم پردازش هوش مصنوعی را از تعاملات تکپاسخی مبتنی بر پرامپت، به
سمت «ایجنتهای پژوهشی و مهندسی خودمختار» با قابلیت اجرای مداوم چنددهساعته جابجا کرد. این دگرگونی نه فقط یک ارتقای جزئی در بنچمارکهای متداول، بلکه پاسخی بنیادین به بحران مالی و اجرایی سازمانهای پیشرو
در پیادهسازی سیستمهای خودکار بود. مدتها بود که استقرار ایجنتهای توسعه نرمافزار به دلیل تصاعد سرسامآور هزینههای فراخوانی مکرر حافظه سیاق (Context Window) و رفتارهای پیشبینینشده در محیطهای عملیاتی،
با موانع جدی مقیاسپذیری روبرو شده بود. آنتروپیک در این بیلد مرزی نه تنها عملکرد استدلال ماشینی را در حل مسائل پیچیده علمی به بیش از دو برابر نسل پیشین رسانده، بلکه با بازطراحی ساختار قیمتگذاری کش، معادله
اقتصادی استقرار سیستمهای هوشمند را به سود تیمهای مهندسی تغییر داده است. توسعهدهندگان در پروژههای بزرگ نرمافزاری همواره با چالشی به نام فرسایش منطقی مدل (Context Degradation) مواجه بودند؛ پدیدهای
که در آن مدل پس از چند ده مرحله تعامل پیدرپی با کدهای حجیم، فرضیات اولیه پروژه را فراموش میکرد یا به تولید راهحلهای سطحی و ناپایدار پناه میبرد. مدلهای سری ۵.۱ با بازسازی حافظه پنهان و یکپارچگی استنتاجی،
این خلاء ساختاری را پوشش دادهاند. در معماری سختافزاری جدید، تخصیص حافظه گرافیکی برای بافر جفت کلید-مقدار (KV-Cache) به گونهای بهینهسازی شده که زمان تأخیر اولین توکن (Time to First Token) حتی در اسناد
بیش از ۲۰۰ هزار توکنی تا ۶۰ درصد کاهش یافته است. این جهش زیرساختی به ایجنت اجازه میدهد بدون وقفه میان فایلهای حجیم جابجا شود و وضعیت متغیرهای سیستم را به صورت برخط و بدون اتلاف زمان پردازش کند. معماری
ادامه مطلب در سایت