Qwen обошёл Claude Fable 5 во фронтенде и стоит втрое дешевле. Где подвох?
Alibaba выложила Qwen3.8-Max 3 августа, через девять дней открыла веса. 2,4 трлн параметров MoE, 95 млрд активных.
На Frontend Code Arena модель встала четвёртой:
🔹 Claude Opus 5 (Max) — 1705;
🔹 Kimi K3 (Max) — 1676;
🔹 Claude Opus 5 (High) — 1669;
🔹 Qwen3.8-Max — 1668;
🔹 Claude Fable 5 (High) — 1630
Разрыв с Fable 5 в 38 пунктов, причём Qwen дышит в спину Opus 5.
Прайс тоже в пользу китайцев: $2 за миллион входных токенов и $6 за выходные против $10 и $50 у Fable 5. За токен выходит в 5-8 раз дешевле.
Теперь то, чего в рейтингах не видно.
В Kilo прогнали обе модели по 10 реальным UI-задачам вслепую. Счёт: 4 победы у Fable 5, 3 у Qwen, 3 ничьи. Таблица говорит одно, живые задачи другое.
Дальше интереснее:
[x] весь прогон обошёлся в $3.05 против $8.44 — втрое дешевле, а не в восемь раз;
[x] среднее время задачи: 7 мин 55 сек у Qwen против 2 мин 11 сек у Fable 5;
[x] Fable сдал все 10 задач с первой попытки, Qwen на трёх потребовал повтора;
[x] на Smart Home у Qwen не загрузились иконки, в Settings он нарушил заданный border-radius;
Почему восьмикратная разница в прайсе схлопнулась до трёхкратной? Qwen долго рассуждает и перепроверяет себя. На одной задаче он сам полез снимать скриншоты в браузере: плюс 15 минут и плюс 90 центов к счёту.
Что брать под свои задачи:
Qwen сильнее в визуале: финансовый дашборд, типографика, свой стиль вместо шаблона. Fable 5 сильнее в дисциплине: держит спецификацию и плотнее укладывает данные на экран.
Внутренний дашборд без дедлайна — берите Qwen, экономия реальная.
Клиентский интерфейс с жёстким ТЗ и сроком: Fable 5. Три повтора из десяти съедят всю разницу в цене, а заодно вечер.
P.S. Лицензия у Max близка к MIT. Атрибуция нужна только выше 100 млн пользователей или $20 млн выручки в месяц. Подозреваю, эта проблема вас пока не беспокоит.
💬 Подпишитесь на Telegram, если хотите ещё больше пользы
#разбор #qwen #фронтенд
Alibaba выложила Qwen3.8-Max 3 августа, через девять дней открыла веса. 2,4 трлн параметров MoE, 95 млрд активных.
На Frontend Code Arena модель встала четвёртой:
🔹 Claude Opus 5 (Max) — 1705;
🔹 Kimi K3 (Max) — 1676;
🔹 Claude Opus 5 (High) — 1669;
🔹 Qwen3.8-Max — 1668;
🔹 Claude Fable 5 (High) — 1630
Разрыв с Fable 5 в 38 пунктов, причём Qwen дышит в спину Opus 5.
Прайс тоже в пользу китайцев: $2 за миллион входных токенов и $6 за выходные против $10 и $50 у Fable 5. За токен выходит в 5-8 раз дешевле.
Теперь то, чего в рейтингах не видно.
В Kilo прогнали обе модели по 10 реальным UI-задачам вслепую. Счёт: 4 победы у Fable 5, 3 у Qwen, 3 ничьи. Таблица говорит одно, живые задачи другое.
Дальше интереснее:
[x] весь прогон обошёлся в $3.05 против $8.44 — втрое дешевле, а не в восемь раз;
[x] среднее время задачи: 7 мин 55 сек у Qwen против 2 мин 11 сек у Fable 5;
[x] Fable сдал все 10 задач с первой попытки, Qwen на трёх потребовал повтора;
[x] на Smart Home у Qwen не загрузились иконки, в Settings он нарушил заданный border-radius;
Почему восьмикратная разница в прайсе схлопнулась до трёхкратной? Qwen долго рассуждает и перепроверяет себя. На одной задаче он сам полез снимать скриншоты в браузере: плюс 15 минут и плюс 90 центов к счёту.
Что брать под свои задачи:
Qwen сильнее в визуале: финансовый дашборд, типографика, свой стиль вместо шаблона. Fable 5 сильнее в дисциплине: держит спецификацию и плотнее укладывает данные на экран.
Внутренний дашборд без дедлайна — берите Qwen, экономия реальная.
Клиентский интерфейс с жёстким ТЗ и сроком: Fable 5. Три повтора из десяти съедят всю разницу в цене, а заодно вечер.
P.S. Лицензия у Max близка к MIT. Атрибуция нужна только выше 100 млн пользователей или $20 млн выручки в месяц. Подозреваю, эта проблема вас пока не беспокоит.
💬 Подпишитесь на Telegram, если хотите ещё больше пользы
#разбор #qwen #фронтенд