آنتروپیک Claude Haiku 5.5 را با کاهش هزینه تا ۹۰ درصد و جهش عملکرد در کنترل کامپیوتر، استدلال و کدنویسی معرفی کرد.
آنتروپیک مدل هوش مصنوعی Claude Haiku ۵.۵ را با تمرکز بر سرعت، هزینه پایین و اجرای وظایف پرتعداد معرفی کرد. این مدل در مقایسه با Haiku ۴.۵ نهتنها هزینه استفاده کمتری دارد، بلکه در آزمونهایی مانند کنترل کامپیوتر، استدلال، دانش و کدنویسی عاملمحور نیز پیشرفت قابلتوجهی نشان میدهد.
یکی از مهمترین تغییرات Haiku ۵.۵ کاهش هزینه استفاده از مدل است. آنتروپیک میگوید میانگین قیمت این مدل حدود ۷۵ درصد کمتر از نسل قبلی است و برای پرامپتهایی با حداکثر ۱۰۰ هزار توکن، کاهش قیمت در برخی شرایط به ۹۰ درصد میرسد.
این مدل برای کاربردهایی مانند خلاصهسازی، دستهبندی دادهها، اجرای کوئریهای پایگاه داده و پشتیبانی بلادرنگ مشتریان طراحی شده است؛ حوزههایی که سرعت پاسخگویی و تعداد بالای درخواستها اهمیت زیادی دارند.
کاهش قیمت توکن؛ اما با یک نکته مهم
Haiku ۵.۵ از Tokenizer جدیدی استفاده میکند و همین تغییر باعث شده مصرف توکن برای انجام یک وظیفه مشخص اندکی بیشتر از نسل قبلی باشد. به همین دلیل، کاهش قیمت اسمی هر توکن الزاماً به همان میزان به کاهش هزینه واقعی منجر نمیشود.
آنتروپیک پیشتر نیز در مدلهای سری Opus ۴.x با چنین شرایطی مواجه شده بود؛ جایی که تغییر Tokenizer مصرف توکن را حدود ۳۰ درصد افزایش داد.
برای پرامپتهای حداکثر ۱۰۰ هزار توکن، Haiku ۵.۵ همچنان تخفیف بسیار قابلتوجهی نسبت به نسل قبلی ارائه میدهد. طبق اعلام آنتروپیک، تقریباً ۹۰ درصد درخواستهای قبلی Haiku در همین محدوده قرار داشتهاند. در مقابل، استفاده از پرامپتهای بیشتر از ۱۰۰ هزار توکن با تعرفهای معادل پنج برابر قیمت معمول محاسبه میشود.
جهش بزرگ در کنترل کامپیوتر
یکی از مهمترین پیشرفتهای Haiku ۵.۵ به قابلیت Computer Use مربوط میشود؛ قابلیتی که به مدل اجازه میدهد بهصورت مستقل با محیط کامپیوتر تعامل داشته باشد.
در نسخه آفلاین بنچمارک OSWorld ۲.۱، مدل جدید امتیاز ۷۲٫۴ درصد را کسب کرده است؛ درحالیکه Haiku ۴.۵ در همین آزمون تنها به ۱۵٫۷ درصد رسیده بود.
این پیشرفت برای عاملهای هوش مصنوعی اهمیت زیادی دارد، زیرا انجام وظایفی که شامل تعامل مداوم با کامپیوتر هستند معمولاً به تعداد زیادی توکن نیاز دارد. بنابراین ترکیب سرعت بالا و قیمت پایین میتواند Haiku ۵.۵ را برای چنین کاربردهایی جذابتر کند.
عملکرد بهتر در دانش و استدلال
آنتروپیک در بنچمارک GDPval-AA v2.۱ نیز عملکرد Haiku ۵.۵ را بهطور محسوسی بالاتر از نسل قبل گزارش کرده است. امتیاز مدل جدید در این آزمون به ۱۶۲۰ رسیده، درحالیکه Haiku ۴.۵ امتیاز ۷۳۵ را ثبت کرده بود.
در Humanity’s Last Exam نیز Haiku ۵.۵ بدون استفاده از ابزارها به امتیاز ۴۵٫۹ درصد و با استفاده از ابزارها به ۵۷٫۴ درصد دست یافته است. این ارقام برای Haiku ۴.۵ بهترتیب ۱۰٫۲ و ۱۸٫۷ درصد بودهاند.
کدنویسی عاملمحور نیز بهتر شده است
در Terminal-Bench ۴.۰ که عملکرد مدلها در وظایف کدنویسی عاملمحور را بررسی میکند، Haiku ۵.۵ امتیاز ۳۹٫۲ درصد را به دست آورده است. Haiku ۴.۵ در این آزمون امتیازی ثبت نکرده بود.
مدل جدید در FrontierCode ۱.۱ نیز به امتیاز ۴۶٫۴ درصد رسیده است. در آزمون استدلال بصری Chartography نیز امتیاز ۴۶٫۴ درصد برای Haiku ۵.۵ گزارش شده است.
با وجود این پیشرفتها، آنتروپیک همچنان Sonnet ۵.۵ و Opus ۵.۵ را برای وظایف پیچیدهتر کدنویسی عاملمحور پیشنهاد میکند؛ بنابراین Haiku ۵.۵ بیشتر برای سناریوهایی طراحی شده که سرعت و هزینه اهمیت بیشتری از حداکثر توان استدلال دارند.
امکان تنظیم میزان استدلال
Haiku ۵.۵ نخستین مدل از خانواده Haiku است که به قابلیت تنظیم سطح استدلال مجهز شده است. کاربران میتوانند میزان پردازش استدلالی مدل را بر اساس نوع کار تغییر دهند و بین کیفیت خروجی، سرعت و هزینه تعادل برقرار کنند.
این قابلیت برای کارهایی مانند خلاصهسازی، فشردهسازی محتوا و اجرای وظایف بهعنوان زیرعامل کاربرد بیشتری دارد.
Haiku ۵.۵ در مقایسه با مدلهای رقیب
آنتروپیک در نتایج منتشرشده خود Haiku ۵.۵ را با GPT-۶ Luna نیز مقایسه کرده است. براساس دادههای ارائهشده از سوی این شرکت، مدل جدید در تمام آزمونهایی که نتیجه هر دو مدل منتشر شده، امتیاز بالاتری به دست آورده است.
بااینحال، Haiku ۵.۵ همچنان در بیشتر آزمونها از Sonnet ۵.۵ عقبتر است. این موضوع با جایگاه Haiku در خانواده مدلهای آنتروپیک نیز همخوانی دارد؛ این مدل بیشتر برای اجرای سریع و ارزان حجم زیادی از وظایف طراحی شده است، درحالیکه مدلهای بزرگتر برای کارهای پیچیدهتر مورد استفاده قرار میگیرند.
تغییرات امنیت سایبری و دسترسی به مدل
آنتروپیک سیاستهای امنیت سایبری Haiku ۵.۵ را نسبت به نسل قبل تغییر داده است. این مدل در مقایسه با Sonnet ۵.۵ دامنه بیشتری از فعالیتهای دفاعی در حوزه امنیت سایبری را پوشش میدهد، اما قابلیتهایی مانند تست نفوذ همچنان مسدود هستند.
سازمانهایی که به قابلیتهای گستردهتر در زمینه امنیت سایبری یا علوم زیستی نیاز دارند، میتوانند برای برنامههای تأیید آنتروپیک درخواست دسترسی ارائه کنند.
Haiku ۵.۵ هماکنون از طریق پلتفرمهای ابری مختلف در دسترس قرار گرفته و کاربران میتوانند آن را از طریق Amazon Web Services، Google Cloud و Microsoft Azure نیز دریافت کنند.
هزینه استفاده از Sonnet ۵.۵ هم کاهش یافت
آنتروپیک همزمان با معرفی Haiku ۵.۵، قیمت خواندن کش Sonnet ۵.۵ را نیز ۵۰ درصد کاهش داده است. هزینه این بخش از ۰٫۲۰ دلار به ۰٫۱۰ دلار برای هر یک میلیون توکن رسیده است.
به گفته شرکت، این تغییر میتواند هزینه اجرای وظایف عاملمحور با Sonnet ۵.۵ را حدود ۲۰ درصد کاهش دهد.
آنتروپیک همچنین ارائه اعتبار ماهانه API را آغاز کرده است تا کاربران بتوانند ابزارها، برنامهها و عاملهای مبتنی بر API این شرکت را آزمایش کنند.
Computer Use به SDKهای آنتروپیک میآید
توسعهدهندگان نیز از طریق بهروزرسانی SDKهای Python و TypeScript به قابلیتهای جدیدی دسترسی پیدا میکنند. این نسخهها پشتیبانی آزمایشی از Computer Use و Browser Use را اضافه میکنند و امکان استفاده از قابلیت تعامل مدل با کامپیوتر و مرورگر را در نرمافزارها و عاملهای هوش مصنوعی فراهم میسازند.
در مجموع، Haiku ۵.۵ تلاش آنتروپیک برای ارائه مدلی سریع و کمهزینه است که بتواند بخش قابلتوجهی از وظایف عاملهای هوش مصنوعی را انجام دهد. جهش عملکرد در کنترل کامپیوتر و کدنویسی، در کنار کاهش قیمت و امکان تنظیم سطح استدلال، میتواند جایگاه این مدل را در کاربردهایی که تعداد درخواستها بسیار زیاد است تقویت کند.
