Запуск задач в новой модели обойдётся в среднем на 75% дешевле по сравнению с предшественницей. При обработке коротких промптов ценник упал сразу на 90%, догнав базовые тарифы конкурентов.

Источник фото: habr.com

Линейку Haiku компания держит как самый быстрый инструмент для рутины: поддержки клиентов, разбора терабайтов текста и фоновой автоматизации.

В обновленной версии сетку тарифов привязали к размеру контекста:

  • Запросы до 100 000 токенов стоят $0,10 за 1 млн входных и $0,50 за 1 млн выходных единиц;
  • Задачи длиннее этого порога обойдутся в $0,50 на входе и $2,50 на выходе.

У прошлого поколения модели на такие короткие диалоги приходилось около 90% всего входящего потока.

Главное новшество: глубину рассуждений теперь настраивают под задачу. Разработчик сам выбирает баланс между скоростью ответа и качеством логики.

Модель уже выкатили в облака Amazon Web Services, Google Cloud и Microsoft Azure.

С такими тарифами запускать легковесных агентов пачками смогут даже небольшие команды со скромным бюджетом.

Что это значит

В ботах и сервисах поддержки теперь выгоднее вовремя сбрасывать историю переписки, чтобы запросы оставались в рамках минимального тарифа.