Войти Позвонить мне
Модели через посредника

Qwen3.8 Flash

Alibaba

Доступ из РФ через посредника тот же путь, что у Max: бесплатный чат без карты, платный API российские карты не принимает
Цена вход / 1М 13 ₽ 0,15 $ / 0,47 $ за 1M токенов (International, официальный прайс Alibaba Cloud) по курсу ЦБ 84,34 ₽
Цена выход / 1М 40 ₽
Качество (Arena) нет в срезе Arena
Для чего в бизнесе
  • дешёвые массовые задачи
  • черновая обработка
  • боты
Официальная страница модели →

Коротко

Qwen3.8 Flash — это младшая и самая дешёвая модель Alibaba. Миллион токенов ответа стоит 40 ₽, меньше, чем у любой другой модели в нашей таблице. Запрос обходится в 13 ₽. Её берут для ботов, черновиков и больших объёмов однотипной работы.

Почему важна цена ответа?

Токен — это кусочек текста, обычно короче слова. Модели берут деньги и за то, что вы им отправили, и за то, что они написали. Ответ почти всегда дороже. Если модель много пишет (карточки товаров, ответы в чате, пересказы звонков), именно цена ответа определяет счёт. У Qwen3.8 Flash она примерно втрое выше цены запроса, а у многих моделей разница пятикратная.

Какие задачи ей по силам?

Простые и повторяющиеся. Бот в мессенджере, который отвечает на частые вопросы по готовому списку. Черновое описание для сотни новых товаров, которое потом поправит человек. Сортировка заявок по видам. Сложных рассуждений от неё ждать не стоит: в открытом срезе Arena её нет, других независимых баллов мы не нашли, так что сначала проверьте её на небольшой пачке своих задач.

Сколько стоит и как платить?

Подписаться на Telegram

Свежие материалы Журнала - в Telegram-канале ultiOS.

Подписаться на TelegramГотов ли ваш бизнес к ИИ-сотруднику?

Alibaba берёт 0,15 $ за миллион токенов запроса и 0,47 $ за миллион токенов ответа (международный тариф). По курсу ЦБ на 26.09.2026 это 13 ₽ и 40 ₽.

Доступ устроен так же, как у старшей Qwen3.8 Max. Бесплатный чат открыт из России без карты. Для платного API российская карта не подойдёт: её отсекает проверка Alibaba Cloud, и в рублях доступ продают посредники с наценкой.

С чем сравнить?

GPT-6 Luna дешевле на запросе (8 ₽), но дороже на ответе (42 ₽). DeepSeek V4.1 Flash стоит 13 ₽ и 51 ₽, зато её сайт и API открыты из России без блокировок.

Что в итоге

Qwen3.8 Flash — это самый экономный вариант, когда модель много пишет и задачи простые. Если нужна не одна модель, а готовое решение под вашу нишу (медицина, автобизнес, недвижимость, ЖКХ), загляните в раздел решений ultiOS.

Источники

Сравнить с

Весь рейтинг и график цена/качество