Alibaba Cloud адаптирует Kimi K3 LLM, снижая задержку до первого токена на 35%

BABA2,53%
По данным Security Times, 27 июля Alibaba Cloud адаптировала суперноды Lingjun Zhenwu M890 для запуска Kimi K3 — большой языковой модели. Совместная оптимизация на уровне чипов, платформы для инференса и самой модели сократила задержку первого токена — время, за которое модель начинает показывать вывод — примерно на 35%, повысив плавность взаимодействий с длинным контекстом. Также Alibaba Cloud заявила, что предоставит API для Kimi K3 через свою AI-платформу Qianwen и Bailian, при этом обе стороны углубят сотрудничество в области отечественных вычислительных мощностей.
Дисклеймер: Информация на этой странице может быть получена из источников третьих сторон и предоставляется только для ознакомления. Она не отражает взгляды или мнения Gate и не является финансовой, инвестиционной или юридической рекомендацией. Торговля виртуальными активами связана с высоким риском. Пожалуйста, не основывайте свои решения исключительно на данных этой страницы. Подробнее смотрите в Дисклеймере.
комментарий
0/400
Нет комментариев