Anthropic در ۷ اکتبر ۲۰۲۶ از Claude Haiku 5.5 رونمایی کرد؛ مدلی که به گفتهی این شرکت ارزانترین، سریعترین و توانمندترین مدل کوچک تاکنونش است. قیمت ورودی آن ۰٫۱۰ دلار به ازای هر ۱ میلیون توکن است، یعنی یکدهم Haiku 4.5. اما این عدد فقط یک بخش ماجراست. در ادامه شرطها و محدودیتها را هم میبینید.
Haiku 5.5 برای چه کاری ساخته شده؟
Anthropic آن را برای کارهای پرحجم و حساس به هزینه معرفی میکند: خلاصهسازی، فشردهسازی کانتکست، کوئری دیتابیس، دستهبندی، پشتیبانی زندهی مشتری و استفاده از مرورگر. در کدنویسی هم قرار است نقش subagent را کنار Opus 5.5 و Sonnet 5.5 بازی کند. Haiku 5.5 اولین مدل Haiku است که تنظیم سطح تلاش (effort) دارد.
قیمت: «۱۰ سنتی» دقیقاً چه شرطی دارد؟
| هر ۱ میلیون توکن | Haiku 5.5 (تا ۱۰۰ هزار) | Haiku 5.5 (بالای ۱۰۰ هزار) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| ورودی | ۰٫۱۰ دلار | ۰٫۵۰ دلار | ۱ دلار | ۲ دلار |
| خروجی | ۰٫۵۰ دلار | ۲٫۵۰ دلار | ۵ دلار | ۱۰ دلار |
| خواندن از کش | ۰٫۰۱ دلار | ۰٫۰۵ دلار | ۰٫۱۰ دلار | ۰٫۱۰ دلار |
قیمت پایین برای پرامپتهای تا ۱۰۰ هزار توکن است. بالاتر از آن، قیمت پنج برابر میشود. طبق گفتهی Anthropic حدود ۹۰٪ درخواستهای Haiku 4.5 زیر این آستانه بودند.
عدد «۷۵٪ ارزانتر» که Anthropic اعلام کرده میانگین است، نه یکدهم. تخفیف ۹۰٪ فقط روی درخواستهای تا ۱۰۰ هزار توکن صدق میکند و بالای آن ۵۰٪ است. Haiku 5.5 توکنایزر جدیدی دارد و برای یک کار مشخص کمی توکن بیشتری مصرف میکند. پس هزینهی واقعی را با تست روی دادهی خودتان بسنجید.
عملکرد: اعداد چه میگویند؟
| بنچمارک | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 | ۱۶۲۰ | ۷۳۵ | ۱۴۳۷ | ۱۸۴۰ |
| OSWorld 2.1 (زیرمجموعهی آفلاین) | ۷۲٫۴٪ | ۱۵٫۷٪ | ۴۸٫۹٪ | ۸۳٫۹٪ |
| Terminal-Bench 4.0 | ۳۹٫۲٪ | ۰٪ | ۱۶٫۴٪ | ۷۰٫۶٪ |
| FrontierCode 1.1 | ۴۶٫۴٪ | — | ۴۲٫۴٪ | ۵۲٫۱٪ |
| Humanity's Last Exam (با ابزار) | ۵۷٫۴٪ | ۱۸٫۷٪ | — | ۶۴٫۵٪ |
الگو روشن است: Haiku 5.5 از Haiku 4.5 و Luna جلوتر است و از Sonnet 5.5 عقبتر. بعضی نکات:
- جهشها بزرگاند، مثلاً Terminal-Bench از ۰ به ۳۹٫۲٪. این بیشتر نشان میدهد Haiku 4.5 در این آزمونهای جدید تقریباً کاری از پیش نمیبرد. تا ارزیابی مستقل منتشر نشود، با احتیاط بخوانید.
- Anthropic خودش میگوید برای کدنویسی عاملمحور پیچیده، Sonnet 5.5 و Opus 5.5 انتخاب بهترند. Haiku برای کارهای محدود و مشخص است.
- «سریعترین» با قید است: Haiku 5.5 در سرعت استاندارد سریعترین مدل Claude است، اما در حالت Fast Mode مدلهای Opus سریعترند.
مشتریان هم نتایجی گزارش کردهاند. Asana بیش از ۳۰٪ کاهش تأخیر دیده، AlphaSense روی ۴۰۰ پرسش به ۰٫۸۴ در برابر ۰٫۷۶ برای Haiku 4.5 رسیده، و Box از ۱۱ امتیاز بهبود با نصف تأخیر خبر داده است. اینها تستهای داخلی خود شرکتهاست.
نکات برای توسعهدهندهها
- شناسه:
claude-haiku-5-5، روی Claude Platform و همچنین AWS، Google Cloud و Azure. راهنمای مهاجرت در مستندات Anthropic هست. - حفاظهای امنیتی: سختگیرانهتر از Haiku 4.5 ولی کمی آسانتر از بقیهی مدلهای اخیر. کارهای دفاعی بیشتری نسبت به Sonnet 5.5 مجازند، اما تست نفوذ و تکنیکهای هجومی مسدودند.
- SDK: پشتیبانی بتای computer use و browser use به SDKهای Python و TypeScript اضافه شده.
خبرهای جانبی
قیمت خواندن از کش Sonnet 5.5 از ۰٫۲۰ به ۰٫۱۰ دلار رسید که طبق Anthropic هزینهی بیشتر کارهای عاملمحور را حدود ۲۰٪ کم میکند. همچنین مشترکان Max و Team این هفته اعتبار ماهانهی API میگیرند: ۱۰۰ دلار برای Max 5x، ۲۰۰ دلار برای Max 20x و حداکثر ۵۰۰ دلار (مشترک) برای Team.
سؤالات متداول
Haiku 5.5 جای Sonnet 5.5 را میگیرد؟ نه. Sonnet 5.5 و Opus 5.5 برای کارهای پیچیدهی کدنویسی بهتر میمانند.
قیمت واقعاً ۹۰٪ کمتر است؟ فقط برای درخواستهای تا ۱۰۰ هزار توکن، آن هم پیش از اثر توکنایزر جدید. میانگین اعلامی ۷۵٪ است.
جمعبندی
Haiku 5.5 برای کارهای ساده و پرحجم، از خلاصهسازی تا subagent، گزینهی بسیار ارزانی به نظر میرسد. اما تخفیف به طول پرامپت بستگی دارد و دادهها از خود Anthropic است. قبل از مهاجرت، روی کار واقعی خودتان تست کنید.
نظرات
برای ثبت نظر وارد شوید.