Запуск задач в новой модели обойдётся в среднем на 75% дешевле по сравнению с предшественницей. При обработке коротких промптов ценник упал сразу на 90%, догнав базовые тарифы конкурентов.

Линейку Haiku компания держит как самый быстрый инструмент для рутины: поддержки клиентов, разбора терабайтов текста и фоновой автоматизации.
В обновленной версии сетку тарифов привязали к размеру контекста:
- Запросы до 100 000 токенов стоят $0,10 за 1 млн входных и $0,50 за 1 млн выходных единиц;
- Задачи длиннее этого порога обойдутся в $0,50 на входе и $2,50 на выходе.
У прошлого поколения модели на такие короткие диалоги приходилось около 90% всего входящего потока.
Главное новшество: глубину рассуждений теперь настраивают под задачу. Разработчик сам выбирает баланс между скоростью ответа и качеством логики.
Модель уже выкатили в облака Amazon Web Services, Google Cloud и Microsoft Azure.
С такими тарифами запускать легковесных агентов пачками смогут даже небольшие команды со скромным бюджетом.
Что это значит
В ботах и сервисах поддержки теперь выгоднее вовремя сбрасывать историю переписки, чтобы запросы оставались в рамках минимального тарифа.