Используем ИИ в своих интересах. Часть 2
Используем ИИ в своих интересах. Часть 2

Полная версия

Используем ИИ в своих интересах. Часть 2

Настройки чтения
Размер шрифта
Высота строк
Поля
На страницу:
2 из 3

Без VPN → GigaChat, YandexGPT, DeepSeek, Qwen, Kandinsky.


Вопрос 5: 152-ФЗ.

Персональные данные → GigaChat, YandexGPT, локальное развёртывание.

Без персональных данных → любая система.


Вопрос 6: оплата.

Рубли → GigaChat, YandexGPT, DeepSeek, Qwen, агрегаторы.

Зарубежная карта → ChatGPT, Claude, Gemini.


3.7. Матрица выбора для России


Задача

Первый выбор

Альтернатива

Почему


Код

Qwen

DeepSeek

Бесплатно, без VPN, качество


Код-ревью

Claude через агрегатор

GigaChat Pro

Точность


Анализ договора

GigaChat Pro

Claude через агрегатор

152-ФЗ, качество


Массовая обработка

DeepSeek

Qwen Flash

Цена


Анализ изображений

Qwen-VL

GigaChat (Kandinsky)

Мультимо-дальность


Анализ видео

Kandinsky

Gemini через агрегатор

Доступность


Генерация изображений

Kandinsky

Шедеврум

Бесплатно, русский язык


Написание текстов

GigaChat

YandexGPT

Русский язык, 152-ФЗ


Автоматизация

GigaChat (Function calling)

YandexGPT (RAG)

Интеграции


Научные исследования

Claude через агрегатор

GigaChat Pro

Воспроизво-димость


Медицинские вопросы

Claude через агрегатор

GigaChat Pro

Надёжность


Юридические вопросы

GigaChat Pro

Claude через агрегатор

152-ФЗ


Бизнес-задачи

GigaChat

YandexGPT

152-ФЗ, интеграции


Повседневные вопросы

GigaChat (Telegram)

YandexGPT (Алиса)

Бесплатно, удобство


Критические решения

Claude через агрегатор

GigaChat Ultra

Максимальная надёжность


3.8. Примеры выбора

Пример первый: вы пишете код.

Задача: написать функцию.

Цена ошибки: низкая.

Формат: текст.

Бюджет: ограничен.

Доступность: без VPN.

152-ФЗ: не важно.

Оплата: рубли.

Выбор: Qwen. Бесплатно, без VPN, качество.


Пример второй: вы анализируете договор с персональными данными.

Задача: анализ договора.

Цена ошибки: высокая.

Формат: текст.

Бюджет: не критичен.

Доступность: без VPN.

152-ФЗ: важно.

Оплата: рубли.

Выбор: GigaChat Pro. 152-ФЗ, качество, доступность.


Пример третий: вы обрабатываете 10 000 отзывов.

Задача: классификация.

Цена ошибки: низкая.

Формат: текст.

Бюджет: ограничен.

Доступность: без VPN.

152-ФЗ: не важно.

Оплата: рубли.

Выбор: DeepSeek. Почему? Цена, скорость, качество.

Пример четвёртый: вы создаёте изображения для блога.

Задача: генерация изображений.

Цена ошибки: низкая.

Формат: текст → изображение.

Бюджет: ограничен.

Доступность: без VPN.

152-ФЗ: не важно.

Оплата: бесплатно.

Выбор: Kandinsky. Бесплатно, русский язык, качество.


Пример пятый: вы анализируете финансовый отчёт.

Задача: финансовый анализ.

Цена ошибки: высокая.

Формат: текст.

Бюджет: не критичен.

Доступность: без VPN.

152-ФЗ: важно.

Оплата: рубли.

Выбор: GigaChat Pro. 152-ФЗ, качество, доступность.


Пример шестой: вы нуждаетесь в максимальной точности.

Задача: критическое решение.

Цена ошибки: очень высокая.

Формат: текст.

Бюджет: не критичен.

Доступность: через агрегатор.

152-ФЗ: не важно (данные обезличены).

Оплата: рубли.

Выбор: Claude через агрегатор. Максимальная надёжность.


3.9. Как выбрать, если не уверены

Если вы не уверены – начните с GigaChat. Почему? Потому что GigaChat доступен без VPN. Принимает рубли. Соответствует 152-ФЗ. Бесплатен для базового использования. Имеет Telegram-бот.

Если GigaChat не справляется – попробуйте YandexGPT. Если нужна экономия – DeepSeek или Qwen.

Если нужна максимальная точность – Claude через агрегатор.

Если нужны изображения – Kandinsky.

Простой принцип: начните с GigaChat. Если не работает – меняйте.


3.10. Как выбрать, если бюджет ограничен

Если бюджет ограничен – начните с бесплатных инструментов.

Бесплатно:

– GigaChat (базовый доступ);

– YandexGPT Lite;

– DeepSeek;

– Qwen;

– Kandinsky;

– Шедеврум.

Дёшево:

– GigaChat Lite – 65 рублей за миллион токенов;

– YandexGPT Lite – от 0,1 рубля за тысячу токенов.

Платно, но доступно:

– GigaChat Pro/Max;

– YandexGPT Pro;

– DeepSeek API;

– Qwen API.

Простой принцип: используйте бесплатные инструменты для всего. Платные – только для критического.


3.11. Как выбрать для бизнеса

Если вы бизнес – три требования.

Первое: 152-ФЗ. Используйте GigaChat или YandexGPT. Или разверните модель локально.

Второе: счёт для бухгалтерии. GigaChat через cloud.ru. YandexGPT через Yandex Cloud. MTS Web Services. Cloud.ru.

Третье: поддержка. Русскоязычная документация. Русскоязычная поддержка. Оплата в рублях.

Простой принцип: для бизнеса – GigaChat и YandexGPT. Для остального – комбинируйте.



Часть

II

. Qwen: китайская модель, которая говорит по-русски

Глава 4. Что такое Qwen и почему он стал основным инструментом в России


4.1. Модель, о которой говорят все

Если вы спросите российского разработчика какой ИИ он использует чаще всего, ответ будет предсказуемым: Qwen. Не ChatGPT. Не Claude. Не DeepSeek. Именно Qwen.

Почему? Потому что Qwen даёт то, что нужно российскому пользователю: доступность без VPN, бесплатный или почти бесплатный доступ, понимание русского языка и качество, сопоставимое с западными флагманами.


4.2. История: Alibaba и её ставка на открытость

Qwen – продукт Alibaba Cloud, облачного подразделения китайского гиганта Alibaba Group. Первая версия модели вышла в 2023 году. С тех пор семейство разрослось до десятков моделей: от компактных до флагманских, от текстовых до мультимодальных.

Ключевое отличие Qwen от многих конкурентов – открытость. Alibaba публикует веса моделей. Любой может скачать их, развернуть локально, дообучить под свои задачи.

Это стратегическое решение. Alibaba не пытается заработать только на API. Она строит экосистему. Открытые модели привлекают разработчиков. Разработчики создают приложения. Приложения приводят пользователей. Пользователи платят за облачные сервисы Alibaba.

Для российского пользователя это означает простое: Qwen можно использовать бесплатно. Через веб-версию. Через API с щедрыми лимитами. Или локально, если есть оборудование.


4.3. Почему разработчики выбрали Qwen

В 2026 году Qwen стал лидером среди китайских моделей в России. 261,1 миллиарда токенов от российских пользователей за первую половину 2026 года. Это больше, чем у GLM (91,2 миллиарда) и Kimi (81,4 миллиарда) вместе взятых. Почему?

Причина первая: доступность. Qwen работает без VPN. Регистрация из России. API через Alibaba Cloud. Бесплатный доступ к базовым моделям.

Причина вторая: качество. Qwen3.5-397B-A17B – флагманская открытая модель. 397 миллиардов общих параметров, 17 миллиардов активных. Это уровень, который раньше был доступен только закрытым моделям.

На бенчмарках Qwen3.5 показывает результаты, близкие к GPT-5.2 и Claude 4.5 Opus. MMLU-Pro: 87.8 против 87.4 у GPT-5.2. GPQA: 88.4 против 87.0 у Claude. AIME 2026: 91.3%.

Причина третья: русский язык. Qwen работает с русским текстом лучше, чем DeepSeek. Это не значит, что он «русская модель». Это значит, что он достаточно хорошо понимает русский, чтобы быть полезным.

Причина четвёртая: мультимодальность. Qwen3.5 – нативная мультимодальная модель. Она понимает текст, изображения и видео. Это открывает сценарии, которые недоступны текстовым моделям.

Причина пятая: цена. Qwen3.8-Flash стоит 0,8 юаня за миллион входных токенов и 2,7 юаня за миллион выходных. Это дёшево. Qwen3.7-Flash ещё дешевле: 0,2 юаня за вход.


4.4. Экосистема моделей Qwen

Qwen – это не одна модель. Это семейство. Понимание различий – ключ к эффективному использованию.

Qwen3.5-397B-A17B – флагманская открытая модель. 397 миллиардов параметров, 17 миллиардов активных. Контекст 262 000 токенов, расширяемый до 1 миллиона. Мультимодальность. Открытые веса.

Qwen3-Max – самая мощная модель. 2,4 триллиона параметров. Контекст 1 миллион токенов. Для самых сложных задач.

Qwen3-Plus – баланс качества и цены. 350 миллиардов параметров. Контекст 1 миллион токенов. Для повседневной работы.

Qwen3-Flash – быстрая и дешёвая. 1250 миллиардов параметров (60 миллиардов активных). Контекст 1 миллион токенов. Для массовых задач.

Qwen-Long – для документов. Контекст 10 миллионов токенов. Для анализа договоров, документации.

Qwen3-Coder – специализированная для кода. До 480 миллиардов параметров. Для генерации, ревью и рефакторинга кода.

Qwen3-VL – для изображений и видео. Мультимодальная. Для анализа визуального контента.


4.5. Что это значит для вас

Если вы разработчик: Qwen3-Coder – ваш инструмент. Бесплатно. Без VPN. Качество, близкое к Claude для кода.

Если вы аналитик: Qwen-Long – для больших документов. 10 миллионов токенов. Это примерно 5000 страниц текста за один раз.

Если вы обычный пользователь: Qwen3-Flash через веб-версию. Бесплатно. Быстро. Достаточно хорошо для большинства задач.

Если вы бизнес: Qwen3-Plus или Qwen3-Max через API. Дёшево. Качественно. Но – данные уходят в Китай. Для персональных данных используйте GigaChat или YandexGPT.

Глава 5. Как получить доступ к Qwen


5.1. Три пути

Qwen доступен тремя способами. Каждый – для своих задач.

Первый: веб-версия. Самый простой. Открываете сайт. Регистрируетесь. Работаете. Бесплатно.

Второй: API через Alibaba Cloud Model Studio. Для автоматизации. Оплата по токенам. Дёшево.

Третий: локальное развёртывание. Для приватности. Скачиваете веса. Разворачиваете на своём оборудовании. Бесплатно.


5.2. Веб-версия: для быстрого старта

Где: Tongyi Qianwen – веб-интерфейс Alibaba. Или Qwen Chat.

Как получить доступ: заходите на сайт. Регистрируетесь через email или телефон. Начинаете работать. Регистрация из России работает. VPN не нужен. Китайский номер не обязателен.

Что доступно: Базовые модели Qwen. Бесплатно. С ограничениями по количеству запросов.

Для чего подходит:

– быстрые вопросы;

– генерация текста;

– работа с кодом;

– анализ изображений (в мультимодальных моделях);

– знакомство с моделью.

Ограничения:

– лимиты на количество запросов;

– нет доступа к флагманским моделям (Qwen3.8);

– данные обрабатываются на серверах Alibaba.


5.3. API через Alibaba Cloud Model Studio

Что это: платформа Alibaba Cloud для доступа к моделям через API. Аналог OpenAI API.

Как получить доступ:

Шаг первый. Зарегистрируйтесь на Alibaba Cloud (alibabacloud.com).

Шаг второй. Активируйте Model Studio.

Шаг третий. Получите API-ключ.

Шаг четвёртый. Используйте API.

Оплата: Оплата по токенам. Принимаются международные карты. Есть бесплатные для новых пользователей.

Бесплатные: Для некоторых моделей – 1 миллион токенов на 90 дней.

Цены (за миллион токенов):

Qwen3.8-Max: 2,5 юаня вход, 10 юаней выход.

Qwen3.5-Plus: 0,8 юаня вход, 4,8 юаня выход.

Qwen3.8-Flash: $0,15 вход, $0,47 выход.

Qwen-Long: 0,5 юаня вход, 2 юаня выход.

Batch-вызовы: Скидка 50% на вход и выход.

Кэширование контекста: Скидка на входные токены. Создание кэша – 125%, попадание – 10%.


5.4. Локальное развёртывание

Что это: скачиваете веса модели. Разворачиваете на своём оборудовании.

Где скачать: Hugging Face. ModelScope. Официальный сайт Qwen.

Что доступно:

Qwen3.8-Max: 2,4 триллиона параметров. Слишком большая для большинства.

Qwen3.8-27B: 27 миллиардов параметров. Требует мощный GPU.

Qwen3.5-2B: 2 миллиарда параметров. Работает на消费级 GPU.

Qwen3.5-35B-A3B: 35 миллиардов параметров, 3 миллиарда активных. MoE-архитектура.

Требования:

Для 27B: минимум 24 GB VRAM (квантизация).

Для 2B: 8 GB VRAM.

Для 35B-A3B: 16 GB VRAM.

Для чего подходит:

– приватность данных;

– кастомизация;

– дообучение;

– работа без интернета.

5.5. Что выбрать

Если вы обычный пользователь: Веб-версия. Бесплатно. Достаточно для большинства задач.

Если вы разработчик: API. Дёшево. Гибко. Много моделей.

Если вы бизнес с требованиями к приватности: Локальное развёртывание. Или API с гарантиями.

Если вы хотите максимальное качество: API. Доступ к Qwen3.8-Max. Флагманская модель.


5.6. Важное предупреждение

Qwen – китайская модель. Данные обрабатываются на серверах Alibaba. Для персональных данных это может быть нарушением 152-ФЗ.

Если вы работаете с персональными данными:

– используйте GigaChat или YandexGPT;

– или разверните Qwen локально;

– или анонимизируйте данные перед отправкой.

Если вы работаете с коммерческой тайной:

– локальное развёртывание;

– или GigaChat / YandexGPT.

Если данные не конфиденциальны:

– используйте Qwen без ограничений.

Глава 6. Выбор модели:

Max

,

Plus

,

Flash

,

Long


6.1. Зачем вообще выбирать

Когда вы открываете Alibaba Cloud Model Studio, перед вами не одна модель Qwen, а несколько. Это не маркетинговый ход. Это отражение реальности: разные задачи требуют разного уровня интеллекта.

Представьте, что у вас в гараже стоит грузовик, спортивный автомобиль и микроавтобус. Все едут. Но если нужно перевезти мебель – вы берёте грузовик. Если нужно быстро добраться до аэропорта – спортивный автомобиль. Если нужно перевезти группу людей – микроавтобус.

С Qwen то же самое. Четыре основные модели: Max, Plus, Flash и Long. Плюс специализированные: Coder для кода, VL для изображений, Audio для аудио. Разберём каждую.


6.2. Qwen3.8-Max: флагман

Основные характеристики:

– 2,4 триллиона общих параметров;

– 950 миллиардов активных параметров (MoE);

– контекст до 1 миллиона токенов;

– максимальный выход: 131 072 токена;

– нативная мультимодальность (текст, изображения, видео);

– поддержка режима;

– Function Calling, структурированный вывод.


Философия модели: решать самые сложные задачи.

Qwen3.8-Max – это тяжёлая артиллерия. Она используется для автономного программирования, сложного анализа, длительных агентных задач.

В внутренних тестах Alibaba Qwen3.8-Max завершил 16-дневный проект по разработке программного обеспечения автономно – от начала до конца, без вмешательства человека. Это уровень, который раньше был доступен только исследовательским лабораториям.

Когда выбирать Max:

– сложное программирование и автономная разработка;

– длительные агентные задачи (часы, дни);

– анализ данных с множеством переменных;

– юридическая проверка документов;

– финансовое моделирование;

– задачи, где качество важнее цены.

Когда НЕ выбирать Max:

– простые задачи (избыточно);

– массовая обработка (дорого);

– случаи, где Flash справляется не хуже.

Цена (за миллион токенов):

– вход: 12 юаней (около $1,7);

– выход: 36 юаней (около $5);

– кэш: 1,5 юаня.


6.3. Qwen3.7-Plus: рабочая лошадка

Основные характеристики:

– около 350 миллиардов общих параметров;

– около 170 миллиардов активных параметров;

– контекст до 1 миллиона токенов;

– максимальный выход: 131 072 токена;

– нативная мультимодальность;

– поддержка режима;

– Function Calling, структурированный вывод.

Философия модели: баланс качества и цены. Plus – рекомендуемая стартовая модель для большинства задач. Она не самая умная и не самая дешёвая, но даёт хороший результат за разумные деньги.

Когда выбирать Plus:

– ежедневная работа;

– генерация кода (не самый сложный);

– анализ документов;

– написание текстов;

– задачи средней сложности;

– случаи, где Max избыточен, а Flash недостаточен.

Когда НЕ выбирать Plus:

– максимально сложные задачи (Max лучше);

– массовая обработка (Flash дешевле).

Цена:

– вход: 1,6 юаня (около $0,23);

– выход: 6,4 юаня (около $0,9);

– кэш: 0,6 юаня.

Почему Plus – хороший выбор:

Согласно официальной документации Alibaba Cloud, для ботов, генерации контента, суммаризации и обработки документов рекомендуется именно Qwen3.7-Plus – «баланс способностей и стоимости, полная поддержка вызова инструментов, контекст 1M подходит для больших кодовых баз».


6.4. Qwen3.8-Flash: быстрая и дешёвая

Основные характеристики:

– 1250 миллиардов общих параметров;

– 60 миллиардов активных параметров;

– контекст до 1 миллиона токенов;

– максимальный выход: 131 072 токена;

– нативная мультимодальность;

– скорость: в 5+ раз быстрее Max;

– Function Calling, структурированный вывод.

Философия модели: скорость и экономия для высоконагруженных задач. Flash – для случаев, когда нужно быстро и дёшево. Она справляется с большинством задач, которые не требуют максимальной глубины.

Когда выбирать Flash:

– массовая обработка;

– классификация;

– извлечение данных;

– чат-боты с высоким трафиком;

– задачи, где скорость критична;

– случаи, где Plus избыточен.

Когда НЕ выбирать Flash:

– сложные рассуждения;

– автономная разработка;

– задачи, требующие максимальной точности.

Цена:

– вход: 0,8 юаня (около $0,11);

– выход: 2,7 юаня (около $0,38).

Важно: для больших документов лучше использовать Long или Plus.


6.5. Qwen-Long: для документов

Основные характеристики:

– контекст до 10 миллионов токенов;

– максимальный выход: 8192 токена;

– только текст (без мультимодальности);

– без Function Calling;

Философия модели: читать много, писать мало. Long – специализированная модель для работы с огромными объёмами текста. 10 миллионов токенов – это примерно 5000 страниц.

Когда выбирать Long:

– анализ книг (целая книга за один раз);

– работа с сотнями договоров;

– анализ технической документации;

– извлечение данных из документов;

– задачи, где нужно «прочитать всё и найти нужное».

Когда НЕ выбирать Long:

– задачи, требующие мультимодальности;

– задачи, требующие Function Calling;

– задачи, где нужен длинный выход (максимум 8192 токена);

– сложные рассуждения.


Цена:

– вход: 0,5 юаня (около $0,07);

– выход: 2 юаня (около $0,28);

– batch: скидка 50%.


6.6. Специализированные модели

Помимо четырёх основных, Qwen предлагает специализированные модели.

Qwen3-Coder – для генерации, ревью и рефакторинга кода. До 480 миллиардов параметров. Доступна в вариантах Plus и Flash.

Qwen3-VL – для анализа изображений. Поддерживает классификацию, обнаружение объектов, описание, OCR, анализ графиков.

Qwen-Image-3.0 – для генерации изображений. Поддерживает до 4,5k токенов на вход, 12 языков, 20+ шрифтов. Текст до 10px остаётся читаемым.

Qwen-Audio-3.0 – для аудио. Синтез речи, понимание речи, эмоциональная выразительность.


6.7. Сравнительная таблица


Критерий

Max

Plus

Flash

Long


Общие параметры

2,4 трлн

~350 млрд

1250 млрд

Нет


Активные параметры

950 млрд

~170 млрд

60 млрд

Нет


Контекст

1M

1M

1M

10M


Макс. выход

131K

131K

131K

8K


Мультимо-дальность

Да

Да

Да

Нет


Thinking

Да

Да

Да

Нет


Function Calling

Да

Да

Да

Нет


Скорость

Медлен-ная

В 3 раза быстрее Max

В 5+ раз быстрее Max

Средняя


Цена (вход)

12 юаней

1,6 юаня

0,8 юаня

0,5 юаня


Цена (выход)

36 юаней

6,4 юаня

2,7 юаня

2 юаня


Лучшее применение

Сложные задачи

Ежедневная работа

Массо-вые задачи

документы


6.8. Как выбрать: практическое руководство

Шаг первый: оцените сложность задачи.

Простая задача – Flash.

Средняя – Plus.

Сложная – Max.

Документ – Long.

Шаг второй: оцените объём.

Массовая обработка – Flash.

Единичные задачи – Plus или Max.

Шаг третий: оцените бюджет.

Ограничен – Flash или Long.

Не ограничен – Max или Plus.

Шаг четвёртый: оцените формат.

Только текст – Long.

Текст + изображения – Max, Plus или Flash.


6.9. Примеры комбинаций

Комбинация 1: Flash + классификация

Задача: классифицировать 10 000 отзывов.

Почему: простая задача, большой объём, ошибка допустима.

Комбинация 2: Plus + анализ документов

Задача: проанализировать отчёт на 100 страниц.

Почему: средняя сложность, нужен хороший результат за разумные деньги.

Комбинация 3: Max + автономная разработка

На страницу:
2 из 3