آنتروپیک Claude Haiku 5.5 را با کاهش هزینه تا ۹۰ درصد و جهش عملکرد در کنترل کامپیوتر، استدلال و کدنویسی معرفی کرد.

آنتروپیک مدل هوش مصنوعی Claude Haiku ۵.۵ را با تمرکز بر سرعت، هزینه پایین و اجرای وظایف پرتعداد معرفی کرد. این مدل در مقایسه با Haiku ۴.۵ نه‌تنها هزینه استفاده کمتری دارد، بلکه در آزمون‌هایی مانند کنترل کامپیوتر، استدلال، دانش و کدنویسی عامل‌محور نیز پیشرفت قابل‌توجهی نشان می‌دهد.

یکی از مهم‌ترین تغییرات Haiku ۵.۵ کاهش هزینه استفاده از مدل است. آنتروپیک می‌گوید میانگین قیمت این مدل حدود ۷۵ درصد کمتر از نسل قبلی است و برای پرامپت‌هایی با حداکثر ۱۰۰ هزار توکن، کاهش قیمت در برخی شرایط به ۹۰ درصد می‌رسد.

این مدل برای کاربردهایی مانند خلاصه‌سازی، دسته‌بندی داده‌ها، اجرای کوئری‌های پایگاه داده و پشتیبانی بلادرنگ مشتریان طراحی شده است؛ حوزه‌هایی که سرعت پاسخ‌گویی و تعداد بالای درخواست‌ها اهمیت زیادی دارند.

Claude Haiku 5.5

کاهش قیمت توکن؛ اما با یک نکته مهم

Haiku ۵.۵ از Tokenizer جدیدی استفاده می‌کند و همین تغییر باعث شده مصرف توکن برای انجام یک وظیفه مشخص اندکی بیشتر از نسل قبلی باشد. به همین دلیل، کاهش قیمت اسمی هر توکن الزاماً به همان میزان به کاهش هزینه واقعی منجر نمی‌شود.

آنتروپیک پیش‌تر نیز در مدل‌های سری Opus ۴.x با چنین شرایطی مواجه شده بود؛ جایی که تغییر Tokenizer مصرف توکن را حدود ۳۰ درصد افزایش داد.

برای پرامپت‌های حداکثر ۱۰۰ هزار توکن، Haiku ۵.۵ همچنان تخفیف بسیار قابل‌توجهی نسبت به نسل قبلی ارائه می‌دهد. طبق اعلام آنتروپیک، تقریباً ۹۰ درصد درخواست‌های قبلی Haiku در همین محدوده قرار داشته‌اند. در مقابل، استفاده از پرامپت‌های بیشتر از ۱۰۰ هزار توکن با تعرفه‌ای معادل پنج برابر قیمت معمول محاسبه می‌شود.

جهش بزرگ در کنترل کامپیوتر

یکی از مهم‌ترین پیشرفت‌های Haiku ۵.۵ به قابلیت Computer Use مربوط می‌شود؛ قابلیتی که به مدل اجازه می‌دهد به‌صورت مستقل با محیط کامپیوتر تعامل داشته باشد.

در نسخه آفلاین بنچمارک OSWorld ۲.۱، مدل جدید امتیاز ۷۲٫۴ درصد را کسب کرده است؛ درحالی‌که Haiku ۴.۵ در همین آزمون تنها به ۱۵٫۷ درصد رسیده بود.

این پیشرفت برای عامل‌های هوش مصنوعی اهمیت زیادی دارد، زیرا انجام وظایفی که شامل تعامل مداوم با کامپیوتر هستند معمولاً به تعداد زیادی توکن نیاز دارد. بنابراین ترکیب سرعت بالا و قیمت پایین می‌تواند Haiku ۵.۵ را برای چنین کاربردهایی جذاب‌تر کند.

عملکرد بهتر در دانش و استدلال

آنتروپیک در بنچمارک GDPval-AA v2.۱ نیز عملکرد Haiku ۵.۵ را به‌طور محسوسی بالاتر از نسل قبل گزارش کرده است. امتیاز مدل جدید در این آزمون به ۱۶۲۰ رسیده، درحالی‌که Haiku ۴.۵ امتیاز ۷۳۵ را ثبت کرده بود.

در Humanity’s Last Exam نیز Haiku ۵.۵ بدون استفاده از ابزارها به امتیاز ۴۵٫۹ درصد و با استفاده از ابزارها به ۵۷٫۴ درصد دست یافته است. این ارقام برای Haiku ۴.۵ به‌ترتیب ۱۰٫۲ و ۱۸٫۷ درصد بوده‌اند.

کدنویسی عامل‌محور نیز بهتر شده است

در Terminal-Bench ۴.۰ که عملکرد مدل‌ها در وظایف کدنویسی عامل‌محور را بررسی می‌کند، Haiku ۵.۵ امتیاز ۳۹٫۲ درصد را به دست آورده است. Haiku ۴.۵ در این آزمون امتیازی ثبت نکرده بود.

مدل جدید در FrontierCode ۱.۱ نیز به امتیاز ۴۶٫۴ درصد رسیده است. در آزمون استدلال بصری Chartography نیز امتیاز ۴۶٫۴ درصد برای Haiku ۵.۵ گزارش شده است.

با وجود این پیشرفت‌ها، آنتروپیک همچنان Sonnet ۵.۵ و Opus ۵.۵ را برای وظایف پیچیده‌تر کدنویسی عامل‌محور پیشنهاد می‌کند؛ بنابراین Haiku ۵.۵ بیشتر برای سناریوهایی طراحی شده که سرعت و هزینه اهمیت بیشتری از حداکثر توان استدلال دارند.

امکان تنظیم میزان استدلال

Haiku ۵.۵ نخستین مدل از خانواده Haiku است که به قابلیت تنظیم سطح استدلال مجهز شده است. کاربران می‌توانند میزان پردازش استدلالی مدل را بر اساس نوع کار تغییر دهند و بین کیفیت خروجی، سرعت و هزینه تعادل برقرار کنند.

این قابلیت برای کارهایی مانند خلاصه‌سازی، فشرده‌سازی محتوا و اجرای وظایف به‌عنوان زیرعامل کاربرد بیشتری دارد.

Haiku ۵.۵ در مقایسه با مدل‌های رقیب

آنتروپیک در نتایج منتشرشده خود Haiku ۵.۵ را با GPT-۶ Luna نیز مقایسه کرده است. براساس داده‌های ارائه‌شده از سوی این شرکت، مدل جدید در تمام آزمون‌هایی که نتیجه هر دو مدل منتشر شده، امتیاز بالاتری به دست آورده است.

بااین‌حال، Haiku ۵.۵ همچنان در بیشتر آزمون‌ها از Sonnet ۵.۵ عقب‌تر است. این موضوع با جایگاه Haiku در خانواده مدل‌های آنتروپیک نیز همخوانی دارد؛ این مدل بیشتر برای اجرای سریع و ارزان حجم زیادی از وظایف طراحی شده است، درحالی‌که مدل‌های بزرگ‌تر برای کارهای پیچیده‌تر مورد استفاده قرار می‌گیرند.

تغییرات امنیت سایبری و دسترسی به مدل

آنتروپیک سیاست‌های امنیت سایبری Haiku ۵.۵ را نسبت به نسل قبل تغییر داده است. این مدل در مقایسه با Sonnet ۵.۵ دامنه بیشتری از فعالیت‌های دفاعی در حوزه امنیت سایبری را پوشش می‌دهد، اما قابلیت‌هایی مانند تست نفوذ همچنان مسدود هستند.

سازمان‌هایی که به قابلیت‌های گسترده‌تر در زمینه امنیت سایبری یا علوم زیستی نیاز دارند، می‌توانند برای برنامه‌های تأیید آنتروپیک درخواست دسترسی ارائه کنند.

Haiku ۵.۵ هم‌اکنون از طریق پلتفرم‌های ابری مختلف در دسترس قرار گرفته و کاربران می‌توانند آن را از طریق Amazon Web Services، Google Cloud و Microsoft Azure نیز دریافت کنند.

هزینه استفاده از Sonnet ۵.۵ هم کاهش یافت

آنتروپیک هم‌زمان با معرفی Haiku ۵.۵، قیمت خواندن کش Sonnet ۵.۵ را نیز ۵۰ درصد کاهش داده است. هزینه این بخش از ۰٫۲۰ دلار به ۰٫۱۰ دلار برای هر یک میلیون توکن رسیده است.

Claude Haiku 5.5

به گفته شرکت، این تغییر می‌تواند هزینه اجرای وظایف عامل‌محور با Sonnet ۵.۵ را حدود ۲۰ درصد کاهش دهد.

آنتروپیک همچنین ارائه اعتبار ماهانه API را آغاز کرده است تا کاربران بتوانند ابزارها، برنامه‌ها و عامل‌های مبتنی بر API این شرکت را آزمایش کنند.

Computer Use به SDKهای آنتروپیک می‌آید

توسعه‌دهندگان نیز از طریق به‌روزرسانی SDKهای Python و TypeScript به قابلیت‌های جدیدی دسترسی پیدا می‌کنند. این نسخه‌ها پشتیبانی آزمایشی از Computer Use و Browser Use را اضافه می‌کنند و امکان استفاده از قابلیت تعامل مدل با کامپیوتر و مرورگر را در نرم‌افزارها و عامل‌های هوش مصنوعی فراهم می‌سازند.

در مجموع، Haiku ۵.۵ تلاش آنتروپیک برای ارائه مدلی سریع و کم‌هزینه است که بتواند بخش قابل‌توجهی از وظایف عامل‌های هوش مصنوعی را انجام دهد. جهش عملکرد در کنترل کامپیوتر و کدنویسی، در کنار کاهش قیمت و امکان تنظیم سطح استدلال، می‌تواند جایگاه این مدل را در کاربردهایی که تعداد درخواست‌ها بسیار زیاد است تقویت کند.