سهشنبه، ۷ مهر ۱۴۰۵

شرکت Anthropic مدل جدید Claude Sonnet 5.5 را منتشر کرده است؛ مدلی که طبق اعلام این شرکت، خروجی را بیش از ۳۰ درصد سریعتر از Sonnet 5 تولید میکند و هزینه انجام هر کار نیز میتواند تا ۳۰ درصد کمتر باشد. این مدل بیشتر برای برنامهنویسی روزمره، کار با اسناد و وظایف معمول طراحی شده، درحالیکه مدل Opus 5.5 همچنان برای پروژههای پیچیده و مسائل باز عملکرد بالاتری دارد.
در آزمون برنامهنویسی Terminal-Bench 4.0، مدل Sonnet 5.5 امتیاز ۷۰.۶ درصد را ثبت کرده؛ Sonnet 5 در همین آزمون ۱۰.۳ درصد امتیاز داشت. در بنچمارک GDPval-AA که عملکرد هوش مصنوعی را در ۴۴ شغل مختلف بررسی میکند، Sonnet 5.5 امتیاز ۱۸۴۴ را کسب کرده و تقریباً به Opus 5.5 با امتیاز ۱۸۴۶ رسیده است. Anthropic میگوید نسخهای که در این آزمون استفاده شده حتی یک باگ داشته که احتمالاً نتیجه را کمی کاهش داده است.
کاربران آزمایشی گزارش دادهاند که مدل جدید ساختار پروژههای کدنویسی را سریعتر درک میکند و با ترکیب چند فراخوانی ابزار، کارها را در مراحل کمتری انجام میدهد. Sonnet 5.5 همچنین نخستین مدل سری Sonnet است که توانسته بازی Pokémon Red را فقط با استفاده از تصاویر صفحه به پایان برساند.
قیمت API تغییر نکرده است: هر یک میلیون توکن ورودی ۲ دلار، هر یک میلیون توکن خروجی ۱۰ دلار و هر یک میلیون توکن خواندن از کش ۰.۲۰ دلار قیمت دارد. کاهش هزینه هر کار بیشتر به این دلیل است که مدل برای انجام یک وظیفه مشابه، توکنهای کمتری مصرف میکند.
Claude Sonnet 5.5 از همین حالا از طریق Anthropic و سرویسهای ابری AWS، Google Cloud و Microsoft Azure با شناسه claude-sonnet-5-5 در دسترس است. این مدل جایگزین Sonnet 5 میشود و Anthropic گفته مدل Haiku 5.5 نیز طی هفتههای آینده عرضه خواهد شد.