Kimi-k2-turbo-preview: новая модель Moonshot AI стала в 4 раза быстрее

Китайская компания Moonshot AI представила новую версию своей языковой модели Kimi — она стала работать в четыре раза быстрее. При этом цену на её использование временно снизили наполовину. Всё это делает модель особенно интересной для тех, кто работает с ИИ в реальном времени.
Kimi-k2-turbo-preview: новая модель Moonshot AI стала в 4 раза быстрее

До недавнего времени модель Kimi от Moonshot AI воспринималась как один из крепких середняков на рынке больших языковых моделей. Но теперь всё может измениться - 1 августа компания представила обновлённую версию Kimi-k2-turbo-preview, которая стала в четыре раза быстрее прежней. Учитывая, что речь идёт о скорости генерации текста, это серьёзный шаг вперёд. И кстати, для новых пользователей до 1 сентября действует скидка 50%.

Что нового: быстрее, но не дешевле

Главное новшество - это, конечно, скорость. Если раньше Kimi обрабатывала около 10 токенов в секунду, то теперь - 40. В пересчёте на обычную речь - примерно 60–80 слов в секунду. Для тех, кто работает с чат-ботами, онлайн-консультантами или системами анализа в реальном времени, это может быть ощутимым апгрейдом.

Контекст, то есть «объём памяти» модели, остался прежним - 131 072 токена. Это означает, что Kimi всё ещё способна работать с очень большими документами без потери качества.

Цены, правда, выросли. Например, при отсутствии кэширования (Cache Miss) 1 миллион входных токенов обойдётся уже в $1.20 (около 110 рублей), а выход - в $5.00 (около 460 рублей). Но до 1 сентября на всё это действует 50-процентная скидка, так что есть шанс попробовать модель по более низкой цене.

Кто такие Moonshot AI и зачем им всё это

Компания Moonshot AI - не просто стартап из Китая. Её основали всего два года назад, в марте 2023-го, но за это время она успела стать одним из «ИИ-тигров» страны. В их числе - и благодаря инвесторам: среди поддерживающих - Alibaba и Tencent.

Главный продукт Moonshot - это как раз Kimi. Он уже умел обрабатывать до 2 миллионов китайских символов за раз и работать с текстом, изображениями и даже кодом. Теперь - к этому добавилась ещё и скорость.

Амбиции у команды серьёзные. Они говорят не только про улучшение текущих возможностей, но и про создание полноценного искусственного общего интеллекта - того самого AGI. В их планах: сделать модели масштабируемыми, мультимодальными и самосовершенствующимися без участия человека.

Чем ответят конкуренты?

На фоне этого релиза стоит вспомнить, что конкуренты не дремлют. Например, у GroqInc есть модели, которые обрабатывают до 200 токенов в секунду. Это в пять раз больше, чем у Kimi-k2-turbo-preview. Но у каждой технологии - своя ниша и свои приоритеты. Не всем нужна максимальная скорость - кому-то важнее стабильность, цена или удобство внедрения.

Что говорят пользователи?

Реакция в сети - скорее положительная. Кто-то шутит про «режим турбо», кто-то уже пробует модель в боевых условиях. Особенно хвалят возможность быстрого анализа больших массивов информации - от ресторанных отзывов до новостных лент. Но звучат и разумные замечания: при росте скорости выросла и стоимость, а это может не устроить всех.

Что в итоге

Новая версия Kimi - это не революция, но важный и очень своевременный апгрейд. Скорость в 40 токенов в секунду делает её пригодной для работы в реальном времени, а скидка до 1 сентября снижает барьер входа. Будет интересно посмотреть, как это повлияет на рынок, где борьба идёт не только за качество, но и за миллисекунды.

Интересный факт: длина контекста Kimi в 131 072 токена - это примерно 500 страниц текста. Такая ёмкость позволяет модели «помнить» целую книгу или даже несколько.
11:10
746
Нет комментариев. Ваш будет первым!