Alibaba представила Qwen3.8-Flash: высокая мощность при низких затратах

Компания Alibaba Cloud официально анонсировала выпуск новой языковой модели Qwen3.8-Flash, основанной на инновационной архитектуре с исходным кодом. Разработка демонстрирует значительный прорыв в области эффективности нейросетей: при общем объеме параметров в сотни миллиардов, для выполнения задач активируется лишь 6 миллиардов параметров. Это позволяет новой модели демонстрировать производительность, сопоставимую или превосходящую показатели Claude 4.6 Opus, сохраняя при этом высокую скорость работы.

Экономическая эффективность и технические характеристики

Одним из ключевых достижений инженеров Alibaba стало радикальное снижение затрат на разработку и эксплуатацию ИИ. Согласно официальным данным, стоимость обучения Qwen3.8-Flash сократилась почти на 90% по сравнению с предыдущей версией Qwen3.7-Plus. Такая оптимизация стала возможной благодаря переработке архитектурных решений, позволяющих более эффективно использовать вычислительные мощности.

Для корпоративных клиентов и независимых разработчиков установлены следующие тарифы на использование API через платформу Qianwen AI:

  • Входные токены: 1 юань за 1 миллион токенов.
  • Выходные токены: 3 юаня за 1 миллион токенов.

Доступность и расширенные возможности

Alibaba придерживается политики открытости, поэтому веса модели уже опубликованы на популярных репозиториях Hugging Face и ModelScope. Для оптимизации локального развертывания представлен вариант с квантованием FP8, что снижает требования к видеопамяти без существенной потери точности.

Параллельно представлена модификация Qwen3.8-Flash-Next, которая обладает расширенным окном контекста до 1 миллиона токенов. Эта версия включает встроенный набор официальных инструментов для глубокой интеграции в рабочие процессы. Модель будет интегрирована в сервис «Qianwen Office», предоставляя пользователям доступ к продвинутым функциям анализа текстов и генерации кода в режиме реального времени.

Выход Qwen3.8-Flash подтверждает тренд на создание «легких» и экономически выгодных моделей, которые не уступают в мощности тяжеловесным решениям. Оптимизация стоимости инференса и открытый доступ к весам могут значительно ускорить внедрение технологий искусственного интеллекта в коммерческие продукты и исследовательские проекты по всему миру.

Материал соответствует редакционной политике Techimo Все публикации проходят проверку фактов и соответствуют стандартам независимой журналистики.
Подробнее

Techimo в Telegram

Самые свежие новости технологий, инсайды и обзоры гаджетов раньше, чем на сайте. Без спама.

Подписаться на канал