Семейство
Зареждане…
Име на модел
Тип лиценз
Зареждане…
Достъп
Достъп чрез чат интерфейс
Достъп чрез API
Достъп за изтегляне
Модалност на входящите данни
Модалност на изходящите данни
Размер (параметри)
Година на публикуване
Включва български
Форма за обратна връзка
Qwen 3
Qwen8B×
Типове достъп
Чат: Безплатен
API: Платен
Изтегляне: Безплатен
Семейство
Qwen
Създател
Alibaba Cloud
Тип лиценз
Apache 2.0
Дата на публикуване
28.04.2025
Модалност
Модалност на входящите данни
Модалност на изходящите данни
Размер в брой параметри
8B
Архитектура на модела
Хибридна архитектура, поддържаща режим ‘Thinking’ и ‘Non-Thinking’, подобрена трансформационна структура
Дължина на контекста
128K токена (освен 0.6B, 1.7B, 4B модели)
Включва ли се български
Неизвестно
Заложени езици
119 езика
Кратко описание на предназначението на модела
Програмиране, математика, агентски способности, инструментална употреба, поддръжка на протокол за контекста на модела
Кратко описание на данните за трениране
36 трилиона токена на 119 езика, включва и синтетични данни
Кратко описание на начина на трениране
4 етапа: мисловна верига с нулев старт, подсилващо обучение за разсъждения, сливане на мисловните режими, общо подсилващо обучение
Информация за данните за тестване
CodeForces Elo, AIME, BFCL, LiveCodeBench, ArenaHard, общи способности
Допълнителни методи или особености на модела
Хибридно мислене, превключване между /think и /no_think токени
Връзки към публикации, описващи модела
Официален блог: https://qwenlm.github.io/blog/qwen3/