Перейти к содержимому

Yi от 01.AI и Ernie от Baidu в 2026: обзор дополнительных китайских AI-платформ

Автор: Silvana · Дата: 02.08.2026 · Verified: 01.09.2026 · Reading time: 12 минут · Prerequisite: 002, 011

Yi от 01.AI и Ernie от Baidu — две значимые китайские AI-платформы помимо большой четвёрки (DeepSeek, Qwen, GLM, Kimi). Yi — bilingual модель (китайский + английский) от компании Kai-Fu Lee, большая часть линейки открыта под Apache 2.0, контекст до 200K токенов, флагман Yi-Lightning (100B MoE) занял 6-е место в мировом рейтинге LMSYS на момент релиза. Ernie от Baidu в 2026 — это ERNIE 5.0 (мультимодальный флагман), ERNIE X1.1 (reasoning) и ERNIE 4.5 Turbo, плюс open-source ветка ERNIE 4.5 до 300B параметров в MoE под Apache 2.0. Для русскоязычного разработчика Yi — рабочий self-hosted вариант через vLLM или Ollama, Ernie — скорее контекст китайского enterprise-ландшафта.

  • В китайском AI-ландшафте помимо DeepSeek, Qwen, GLM и Kimi есть ещё две значимые платформы: Yi от компании 01.AI (основатель — Kai-Fu Lee) и Ernie/文心 от Baidu (крупнейший китайский поисковик).
  • Yi — bilingual модель (китайский + английский), большая часть линейки открыта под Apache 2.0, есть варианты с контекстом до 200K токенов. Флагман Yi-Lightning (100B MoE, октябрь 2024) занял 6-е место в мировом рейтинге LMSYS и 1-е среди китайских моделей на момент релиза.
  • Ernie — линейка Baidu. Актуальная генерация в 2026: ERNIE 5.0 (мультимодальный флагман), ERNIE X1.1 (reasoning), ERNIE 4.5 Turbo (баланс). В июне 2025 Baidu выпустила семейство ERNIE 4.5 open-source под Apache 2.0 — до 300B параметров в MoE-архитектуре.
  • 01.AI в 2025 году сделала стратегический пивот: от «просто foundation-моделей» к enterprise-платформе WorldWise и «AI-советникам» (Boss AI, Investor AI, TopSales AI). Foundation-модели по-прежнему открыты и доступны через API.
  • Ernie для международного пользователя — сложный: требует китайский номер телефона для регистрации потребительского чата 文心一言, enterprise-API через Baidu AI Cloud тоже с китайской верификацией.
  • Yi — гораздо проще: веса на Hugging Face, deploy через vLLM/Ollama/llama.cpp, никаких региональных барьеров для self-hosted варианта.
  • Для русскоязычного разработчика в 2026: Yi имеет смысл как bilingual open-source модель для self-hosted RAG и bilingual чатов. Ernie — скорее для того, чтобы понимать китайский enterprise-ландшафт; для повседневных задач выгоднее DeepSeek, Qwen или Kimi.

В обзоре китайских AI-платформ мы разобрали большую четвёрку: DeepSeek, Qwen, GLM (Zhipu) и Kimi (Moonshot). Но китайская AI-экосистема на них не заканчивается. Есть ещё как минимум два игрока, которых стоит знать: Yi от 01.AI и Ernie от Baidu.

Мысленный образ: если DeepSeek — это Ferrari («лидер по цене-качеству»), Qwen — это Toyota Corolla («универсально, надёжно, дёшево»), Kimi — это грузовик («200 тысяч токенов контекста»), то Yi — это Volvo («академическая инженерия, bilingual корни, meritocracy по бенчмаркам»), а Ernie — это Great Wall («enterprise-machine крупнейшего поисковика в стране, интегрирована во всё, но за пределами Китая почти неизвестна»).

Обе платформы важны, но по разным причинам:

  • Yi — это открытая bilingual модель с академической родословной. Полезна разработчику для self-hosted deploy, для RAG на смешанных корпусах, для understanding «что делает китайский open-source».
  • Ernie — это отражение того, как крупнейший китайский поисковик отвечает на AI-революцию. Baidu не хочет отставать от OpenAI и Anthropic, поэтому в июне 2025 открыла целое семейство ERNIE 4.5. Для русского разработчика это редко нужный инструмент, но знать про него полезно.

Разберём по порядку.

Основатель 01.AI — Kai-Fu Lee (李开复). Это одна из самых узнаваемых фигур в китайском IT:

  • Работал в Apple (Speech Group, конец 1980-х), Microsoft Research Asia (президент-основатель, 1998), Google Greater China (президент, 2005–2009).
  • В 2009 году основал венчурный фонд Sinovation Ventures (инкубатор и VC для китайских стартапов).
  • В мае 2023 года основал 01.AI в Пекине. Компания достигла статуса unicorn за шесть месяцев (01.ai/#about, проверено 02.08.2026).

Kai-Fu Lee — автор книги «AI Superpowers» (2018), где сравнивает китайский и американский подходы к AI. У него репутация человека, который понимает и Кремниевую Долину, и Пекин. Это влияет на то, как 01.AI делает продукт: bilingual с первого дня, open-source как часть стратегии, публичные бенчмарки как язык маркетинга.

Модели Yi выходили последовательно, каждая на новом уровне:

Ноябрь 2023 — Yi (первое поколение). Базовые модели Yi-6B и Yi-34B, плюс варианты Yi-6B-Chat и Yi-34B-Chat. Отдельно — Yi-6B-200K и Yi-34B-200K с контекстным окном 200 тысяч токенов (HuggingFace 01-ai, проверено 02.08.2026). На момент выхода Yi-34B-Chat занял второе место на AlpacaEval (после GPT-4 Turbo).

Январь 2024 — Yi-VL. Multimodal-модели Yi-VL-6B и Yi-VL-34B: vision + language, для работы с изображениями.

Март 2024 — Yi-9B. Промежуточная модель, оптимизированная под коды и математику.

Май 2024 — Yi-1.5. Обновлённая линейка: Yi-1.5-6B, Yi-1.5-9B, Yi-1.5-34B (и Chat-варианты). Continuous pre-training на 500B дополнительных токенов, fine-tuning на 3M sample’ов. Улучшили coding, math, reasoning (HuggingFace Yi-1.5-34B-Chat, проверено 02.08.2026). Контекст: 4K / 16K / 32K.

Сентябрь 2024 — Yi-Coder. Специализированная code-модель до 10B параметров. Позиционировалась как state-of-the-art для программирования на 52+ языках.

Октябрь 2024 — Yi-Lightning. Флагман: 100B параметров в архитектуре Mixture-of-Experts. На LMSYS Chatbot Arena Yi-Lightning занял 6-е место в мире и 1-е место среди китайских моделей (01.ai, проверено 02.08.2026).

2025 — стратегический пивот. В марте 2025 года 01.AI представила WorldWise Enterprise LLM Platform — платформу для enterprise-deploy foundation-моделей с fine-tuning tools. Далее компания сфокусировалась на TrueNorth AI Decision Platform: Boss AI (для CEO), Investor AI (для инвесторов и M&A), TopSales AI (для B2B/govtech продаж). Это движение от «мы делаем модели» к «мы делаем AI-советников для крупного бизнеса».

Foundation-модели при этом никуда не делись: они по-прежнему доступны через API-платформу и open-source. Но фокус компании сместился.

Основная линейка, доступная в open-source (HuggingFace 01-ai, model cards, проверено 02.08.2026):

МодельПараметрыКонтекстЛицензияСпециализация
Yi-1.5-6B / Chat6B4K, 16K, 32KApache 2.0Легковесная, personal use
Yi-1.5-9B / Chat9B4K, 16K, 32KApache 2.0Coding, math
Yi-1.5-34B / Chat34B4K, 16K, 32KApache 2.0Универсальная, top benchmark
Yi-6B-200K6B200KApache 2.0Длинный контекст, легковесная
Yi-34B-200K34B200KApache 2.0Длинный контекст, качество
Yi-Coder-9B9B128KApache 2.0Программирование
Yi-VL-6B / 34B6B / 34B4KApache 2.0Vision + language

Yi-Lightning (100B MoE) распространяется через API-платформу, не open-source.

Официальный портал API-доступа для Yi — platform.lingyiwanwu.com (零一万物-大模型开放平台, «01.AI Open Platform»). Это китайская платформа, ориентированная в первую очередь на внутренний рынок; для международного пользователя доступ и оплата могут быть затруднены (нужны китайская карта или посредник).

Публичные подтверждённые данные о линейке API-моделей на конец 2024:

  • Yi-Lightning — флагман, 100B MoE. Позиционирован как «самая быстрая и качественная модель 01.AI» для production-задач.
  • Yi-Large — предыдущий флагман, доступен для fine-tuning.
  • Yi-Medium — рабочая лошадка.

Актуальные цены на 2026 не подтверждены из первоисточника (портал доступен ограниченно из-за пределов Китая). Если нужен точный ценник — platform.lingyiwanwu.com через китайскую сеть или посредника.

Практический совет: для международного использования разумнее взять open-source Yi-1.5-34B и развернуть у себя через vLLM или llama.cpp. Это надёжнее, дешевле в долгую и без региональных проблем.

Yi обучалась на 3T токенов в multilingual корпусе с акцентом на английский и китайский (GitHub 01-ai/Yi, проверено 02.08.2026). Формально она bilingual EN+CN, но по факту в корпусе есть и другие языки.

На русском Yi работает — но качество ощутимо ниже, чем на английском или китайском. Для русскоязычных задач лучше выбирать модели, специально обученные на русском (Qwen, DeepSeek, Kimi показывают лучший результат на русском out-of-the-box).

Yi имеет смысл если:

  • Нужна bilingual модель EN+CN и русский — не главный язык.
  • Нужен open-source deploy без региональных ограничений.
  • Есть смешанный корпус на английском и китайском для RAG.

Yi поддерживает все стандартные способы deploy (HuggingFace Yi-1.5-34B-Chat, проверено 02.08.2026):

Через vLLM (production-grade):

Окно терминала
pip install vllm
vllm serve "01-ai/Yi-1.5-34B-Chat"

Через Transformers (для экспериментов):

from transformers import AutoTokenizer, AutoModelForCausalLM
tokenizer = AutoTokenizer.from_pretrained("01-ai/Yi-1.5-34B-Chat")
model = AutoModelForCausalLM.from_pretrained(
"01-ai/Yi-1.5-34B-Chat",
device_map="auto"
)
messages = [{"role": "user", "content": "Расскажи про морскую волну."}]
inputs = tokenizer.apply_chat_template(
messages, add_generation_prompt=True, return_tensors="pt"
).to(model.device)
outputs = model.generate(inputs, max_new_tokens=256)
print(tokenizer.decode(outputs[0]))

Через Ollama / llama.cpp / LM Studio: Доступны GGUF-квантизации Yi (4-bit, 8-bit) в community-репозиториях. Yi-1.5-9B легко запускается на потребительском MacBook, Yi-1.5-34B — уже требует RTX 4090 24GB или Mac Studio.

Требования по железу для полноразмерного deploy:

  • Yi-1.5-6B — 12–14 GB VRAM в FP16.
  • Yi-1.5-9B — 18–20 GB VRAM.
  • Yi-1.5-34B — 68–70 GB в FP16 (нужно 2× A100 80GB или квантизация 4-bit → умещается в одну RTX 4090).
  • Компаниям, которым нужна bilingual EN+CN модель с открытыми весами и Apache 2.0 (можно использовать коммерчески).
  • Разработчикам, которые строят self-hosted RAG и хотят контроль над всей цепочкой.
  • Исследователям, которым важна прозрачность архитектуры и наличие статей (arxiv:2403.04652).
  • Тем, кому важен 200K контекст для длинных документов, и при этом бюджет на inference ограничен (Yi-34B-200K — редкое сочетание).

Yi не подходит:

  • Если вы работаете только с русскоязычными данными — берите DeepSeek, Qwen или Kimi.
  • Если вам нужна SOTA-модель на 2026 — Yi-Lightning уступает свежим GLM-4.6, Qwen 3, DeepSeek V3.
  • Если вам нужна production-инфраструктура через готовый API из-за пределов Китая — доступ к platform.lingyiwanwu.com проблемный.

Baidu (百度) — крупнейший китайский поисковик, основан Robin Li в 2000 году. Компания диверсифицирована: поиск, реклама, AI-облако, автономные автомобили Apollo, карты Baidu Maps, AI-платформа PaddlePaddle. С точки зрения размера — это китайский аналог Google/Alphabet.

Для AI важно понимать: Baidu вложилась в AI-исследования задолго до ChatGPT. PaddlePaddle — китайский open-source deep-learning фреймворк, аналог PyTorch/TensorFlow — запущен ещё в 2016 году. Внутри Baidu десятки исследовательских лабораторий, публикации на NeurIPS/ICML/ACL идут в промышленных объёмах.

Когда OpenAI выпустила ChatGPT в конце 2022, Baidu была одним из первых китайских гигантов, кто ответил своим чатботом. Так появился 文心一言 (Wenxin Yiyan, «Ernie Bot») в марте 2023 года.

Модель Ernie старше чем ChatGPT: первое поколение вышло в 2019 году как pre-trained language model на базе PaddlePaddle. Хронология:

  • ERNIE 1.0 (2019) — pre-trained language model с knowledge-enhanced подходом (внедрение знаний из графов).
  • ERNIE 2.0 (2020) — continuous learning framework.
  • ERNIE 3.0 (2021) — 10B параметров, задачи NLU/NLG.
  • ERNIE 3.0 Titan (2021) — 260B параметров, крупнейшая на тот момент китайская языковая модель.
  • ERNIE Bot 文心一言 (март 2023) — потребительский чат-продукт, аналог ChatGPT.
  • ERNIE 4.0 (октябрь 2023) — flagship-модель, конкурент GPT-4 по бенчмаркам от Baidu.
  • ERNIE 4.5 (июнь 2025) — семейство MoE-моделей, открытое под Apache 2.0.
  • ERNIE X1 (2025) — reasoning-модель, аналог o1/DeepSeek R1.
  • ERNIE 5.0 (2026) — актуальный флагман: мультимодальный, deep reasoning, 119K контекст.

Baidu активно продвигает Ernie как «китайский GPT» и интегрирует во все свои сервисы: Baidu Search, Baidu Maps, Baidu Netdisk, Baidu Xiaodu (умные колонки).

По данным Baidu AI Cloud (cloud.baidu.com/product/wenxinworkshop, проверено 02.08.2026):

МодельТипКонтекстЦена inputЦена output
ERNIE 5.0Multimodal flagship, deep reasoning119K¥0.006–0.01 / 1K токенов¥0.024–0.04 / 1K
ERNIE X1.1 PreviewReasoning, tool calling, agent64K¥0.001 / 1K¥0.004 / 1K
ERNIE 4.5 Turbo VLVision + language128K(не указано в источнике)(не указано в источнике)
ERNIE 4.5 TurboText generation, снижение галлюцинаций(не указан)¥0.0008 / 1K¥0.0032 / 1K
ERNIE-4.5-VL-28B-A3BOpen-source MoE, 280B total128KSelf-hostedSelf-hosted

Цены в юанях: 1 юань ≈ 12 рублей на 02.08.2026. Для сравнения в долларах: ERNIE 5.0 input ≈ $0.86–1.44 за миллион токенов, output ≈ $3.44–5.75 за миллион. Это ощутимо дешевле чем OpenAI GPT-5.6 Sol ($5 / $30), примерно на уровне DeepSeek V3.

Практическая оговорка: цены Baidu в юанях и оплата через китайские платёжные системы. Без китайского юрлица или посредника подписка невозможна.

Это Baidu-аналог ChatGPT для конечных пользователей. Доступен на wenxin.baidu.com (ранее — yiyan.baidu.com, теперь редирект).

Ключевые особенности:

  • Бесплатная версия — базовый доступ к ERNIE 4.5.
  • 文心大模型 X1 / X1.1 — reasoning-режим для сложных задач, включён в pro-подписку.
  • Мультимодальность: работа с картинками, генерация изображений, обработка PDF.
  • Интегрирован с Baidu Search: в отличие от ChatGPT, ERNIE Bot по умолчанию имеет доступ к живому поиску в Baidu.

Регистрация: требует китайский номер телефона (+86). Без него верификация не проходит. Для международного пользователя есть варианты через VoIP-сервисы или посредников, но это неудобно и нестабильно.

Подписка: Wenxin Plus / Wenxin Pro стоят порядка ¥60–200 в месяц (курс на 02.08.2026: ≈ 720–2400 рублей). Оплата — через WeChat Pay, Alipay или банковскую карту китайского банка. Для международного пользователя оплата почти невозможна без китайского посредника.

В июне 2025 года Baidu сделала стратегический шаг: открыла всё семейство ERNIE 4.5 под Apache License 2.0 (GitHub PaddlePaddle/ERNIE, проверено 02.08.2026).

Семейство включает 10 вариантов:

  • LLM (текстовые):
    • ERNIE-4.5-300B-A47B (300B total, 47B активных на токен, MoE)
    • ERNIE-4.5-21B-A3B (21B total, 3B активных на токен, MoE)
    • ERNIE-4.5-0.3B (dense модель, для edge-deploy)
  • VLM (мультимодальные):
    • ERNIE-4.5-VL-424B-A47B
    • ERNIE-4.5-VL-28B-A3B (280B total в некоторых источниках)

Технические характеристики флагмана ERNIE-4.5-300B-A47B-Base (HuggingFace baidu/ERNIE-4.5-300B-A47B-Base-PT, проверено 02.08.2026):

ПараметрЗначение
Total параметры300B
Активные параметры47B на токен
АрхитектураMoE (Mixture-of-Experts)
Контекст131,072 токенов (128K)
Слои54
Attention heads64 Query / 8 Key-Value
Text experts64 total / 8 активных
Vision experts64 total / 8 активных
MMLU-Pro score69.5
ЯзыкиEnglish + Chinese
ФорматBF16
ЛицензияApache 2.0 (коммерческое использование разрешено)

Deploy требует серьёзной инфраструктуры: 300B параметров в MoE-архитектуре не помещаются на одну GPU. Нужно кластер 8× H100 или квантизация FP8 / 4-bit / 2-bit (Baidu поддерживает всё три).

ERNIEKit — фреймворк для fine-tuning, включает SFT, DPO, LoRA-варианты. FastDeploy — production-ready решение для inference на разном железе.

Enterprise-путь для Ernie — Baidu AI Cloud (百度智能云, cloud.baidu.com). Платформа Qianfan (千帆, cloud.baidu.com/product/wenxinworkshop) даёт:

  • API-доступ ко всей линейке ERNIE (5.0, 4.5 Turbo, X1.1, Turbo VL).
  • Fine-tuning инструменты.
  • Vector DB и RAG-инфраструктуру.
  • Agent Building Studio.
  • Enterprise-грейд SLA.

Регистрация и оплата — через китайское юрлицо, налоговый номер, банковский счёт в CN. Международный доступ формально возможен через Baidu International Cloud, но по факту сложен: документация в основном на китайском, поддержка на английском ограниченная.

ERNIE 4.5 официально поддерживает English + Chinese (в model card на Hugging Face заявлены оба языка). MMLU-Pro score 69.5 — это англоязычный бенчмарк. На русском модель работать может, но качество не гарантировано и уступает Qwen / DeepSeek на русских данных.

  • Компаниям, работающим на китайском рынке и внутри китайского enterprise-ландшафта. Baidu — это ключевой AI-провайдер для крупных китайских корпораций.
  • Разработчикам, которые хотят понимать китайский enterprise AI-стек и его отличия от западного.
  • Тем, кто может развернуть open-source ERNIE 4.5 у себя (300B параметров) и нуждается в bilingual EN+CN модели c большим контекстом (128K).

Ernie не подходит:

  • Русскоязычному разработчику для повседневных задач. Регистрация чата и API затруднена без китайского юрлица.
  • Если нужна SOTA-модель на русском — Qwen 3, DeepSeek V3, Kimi K1.5 будут удобнее.
  • Если бюджет ограничен: DeepSeek на open-router или через российские посредники доступнее.

Часть 3 · Сложности использования из РФ и мира

Заголовок раздела «Часть 3 · Сложности использования из РФ и мира»

Обе платформы — китайские, но по-разному «китайские» с точки зрения доступности:

Yi (01.AI):

  • Open-source веса на Hugging Face — доступ без ограничений. Скачать Yi-1.5-34B-Chat может любой.
  • Self-hosted через vLLM, Ollama, llama.cpp — работает где угодно.
  • Enterprise-платформа TrueNorth AI ориентирована на глобальный рынок (сайт на английском, страница «for global industries» — 01.ai/global).
  • API-платформа lingyiwanwu.com — китаецентричная, оплата и регистрация могут быть затруднены.

Ernie (Baidu):

  • Open-source веса ERNIE 4.5 на Hugging Face — доступ без ограничений.
  • Self-hosted 300B MoE требует серьёзной инфраструктуры (кластер H100).
  • Потребительский чат 文心一言 — требует китайский номер телефона (+86).
  • Enterprise API (Baidu AI Cloud) — регистрация через китайское юрлицо, оплата в юанях через китайские платёжные системы.
  • Международная версия Baidu International Cloud — есть, но с ограничениями.

Для русскоязычного разработчика в 2026:

  • Yi self-hosted — реальный сценарий использования.
  • Ernie 4.5 self-hosted — возможен, но требует ощутимой инфраструктуры.
  • Yi/Ernie через API — трудный путь, легче взять DeepSeek / Qwen / Kimi.

Оплата китайских API из России — отдельная тема. Основные варианты:

  • Российские посредники, которые перепродают доступ к китайским API (комиссия 10–20%).
  • Юрлицо в Гонконге или Сингапуре с банковской картой международного стандарта.
  • OpenRouter — не размещает Yi и Ernie в 2026, но иногда появляются community-провайдеры.

Мысленная схема выбора между китайскими AI-платформами в 2026:

Yi имеет смысл если:

  • Нужен bilingual open-source EN+CN.
  • Нужен большой контекст 200K на open-source (Yi-34B-200K).
  • Строите self-hosted RAG на смешанных корпусах.
  • Хотите модель с прозрачной академической родословной и статьями.

Ernie имеет смысл если:

  • Вы на китайском рынке или работаете с китайскими корпорациями.
  • Хотите развернуть self-hosted ERNIE 4.5 (300B MoE) для enterprise-задач.
  • Нужно понимать китайский enterprise AI-стек.

Ни то, ни другое — выбирайте:

  • DeepSeek — лидер по цене-качеству, отличный русский.
  • Qwen 3 — если нужна универсальная модель с широкой линейкой размеров.
  • Kimi — если нужен длинный контекст 200K через удобный API.
  • GLM-4.6 — если нужен reasoning на уровне DeepSeek R1 с китайской поддержкой.

Подробнее — в обзоре китайских AI-платформ и энциклопедии по DeepSeek.

Yi (01.AI):

  • Open-source: Yi-1.5 (6B/9B/34B), Yi (первое поколение), Yi-Coder, Yi-VL — всё под Apache 2.0. Веса и inference-код на Hugging Face.
  • Proprietary: Yi-Lightning (100B MoE, flagship), доступен только через API-платформу.
  • Отношение: большая часть линейки открыта, флагман закрыт. Это типичная стратегия «open-source для комьюнити, closed для monetization».

Ernie (Baidu):

  • Open-source: ERNIE 4.5 (10 моделей, до 300B), ERNIE 4.5 VL — открыты под Apache 2.0 с июня 2025.
  • Proprietary: ERNIE 5.0 (актуальный флагман), ERNIE X1.1 (reasoning), ERNIE 4.5 Turbo — доступны только через Baidu AI Cloud API.
  • Отношение: Baidu открыла целое семейство, но актуальный флагман 5.0 и reasoning-модель X1.1 остаются proprietary. Это отражает стратегический выбор: догоняющее семейство (4.5) — как open-source для комьюнити и внимания разработчиков, лидирующее (5.0) — для monetization через enterprise.

Такая двухслойная стратегия «open-source семейство N-1 + proprietary флагман N» становится стандартом в китайском AI (это делают и Qwen, и Kimi, и GLM).

Сводная таблица китайских AI-платформ (verified из первоисточников, август 2026):

ПлатформаФлагманOpen-sourceКонтекстМеждународный доступ
Yi (01.AI)Yi-Lightning (100B MoE, prop.)Yi-1.5 (6B/9B/34B, Apache 2.0), 200K вариант32K / 200KВеса — да, API — сложно
Ernie (Baidu)ERNIE 5.0 (prop.)ERNIE 4.5 семейство (до 300B, Apache 2.0)128K / 119KВеса — да, API — сложно, чат — китайский номер
Qwen 3Qwen 3 flagshipQwen 3 open-source семействодо 1MВеса — да, API через Alibaba Cloud — сложно
GLM-4.6GLM-4.6GLM-4-9B и др. открыты128K–200KВеса — да, API через bigmodel.cn — сложно
Kimi K1.5Kimi K1.5нет200K–1MAPI через platform.moonshot.cn — сложно
DeepSeek V3DeepSeek V3DeepSeek V3 open-source128KВеса — да, API через platform.deepseek.com — доступно

Детали по каждой платформе — в соответствующих статьях энциклопедии.

Задача: чат-помощник для международной команды, где сотрудники говорят на английском и китайском.

Стек:

  • Yi-1.5-34B-Chat через vLLM на 2× A100 или 1× A100 80GB с квантизацией 4-bit.
  • Кастомный system prompt на двух языках.
  • Frontend на Streamlit или Gradio.

Почему Yi, а не Qwen: у Yi изначально bilingual-фокус EN+CN. Qwen сильнее в китайском, но в EN уступает. Для команды 50/50 EN/CN Yi даёт равномерное качество.

Use-case Yi #2: RAG на смешанном корпусе документов

Заголовок раздела «Use-case Yi #2: RAG на смешанном корпусе документов»

Задача: юридическая документация клиента на английском + внутренние регламенты компании на китайском.

Стек:

  • Yi-34B-200K для генерации ответа с длинным контекстом.
  • Chunking + embedding через bge-large-zh-v1.5 (bilingual embedding).
  • Векторная база: Milvus или Qdrant.

Почему 200K контекст важен: юридические документы могут занимать 50–100K токенов. Yi-34B-200K помещает целый документ в контекст, что снижает потребность в агрессивном chunking.

Задача: агент, который читает research-статьи (arXiv) на английском и китайском, собирает выжимку, отвечает на вопросы.

Стек:

  • Yi-1.5-9B-Chat локально через Ollama на MacBook Pro M3 Max.
  • Скрипт на Python скачивает PDF, конвертирует в текст, отдаёт Yi.
  • CLI-интерфейс.

Почему локально: research-статьи могут быть под NDA, отправлять их в облачные API — риск. Yi-1.5-9B помещается в 20 GB RAM с квантизацией и работает на MacBook.

Use-case Yi #4: Fine-tuning для узкой доменной задачи

Заголовок раздела «Use-case Yi #4: Fine-tuning для узкой доменной задачи»

Задача: генерация технических описаний для e-commerce на английском.

Стек:

  • Yi-1.5-6B-Base как основа.
  • LoRA fine-tuning на 5000 примеров товарных описаний.
  • Инференс через vLLM.

Почему Yi 6B: маленькая модель дешёвая в fine-tuning (одна RTX 4090 хватает), Apache 2.0 позволяет коммерческое использование.

Use-case Ernie #1: Понимание китайского enterprise AI-ландшафта

Заголовок раздела «Use-case Ernie #1: Понимание китайского enterprise AI-ландшафта»

Задача: маркетинговый исследователь готовит отчёт по AI-стеку крупных китайских компаний.

Стек:

  • ERNIE Bot 文心一言 (через посредника с китайским номером) для сравнения с ChatGPT.
  • Изучение Baidu AI Cloud, Qianfan, ERNIEKit, FastDeploy.
  • Документация на китайском (перевод через Kimi или Qwen).

Почему Ernie: чтобы понимать, как Baidu видит AI-революцию, нужно потрогать её продукт руками.

Use-case Ernie #2: Self-hosted ERNIE 4.5 для крупной корпорации

Заголовок раздела «Use-case Ernie #2: Self-hosted ERNIE 4.5 для крупной корпорации»

Задача: крупный enterprise хочет open-source foundation model на своей инфраструктуре для внутреннего чатбота с bilingual поддержкой.

Стек:

  • ERNIE-4.5-300B-A47B на кластере 8× H100 (или ERNIE-4.5-21B-A3B на 2× H100).
  • FastDeploy для inference.
  • ERNIEKit для fine-tuning на корпоративных данных.

Почему ERNIE, а не Qwen: обе модели open-source и bilingual. ERNIE в мультимодальных VL-вариантах может быть сильнее для документов с картинками. Qwen проще в комьюнити-поддержке.

Use-case Ernie #3: Enterprise API для клиента на китайском рынке

Заголовок раздела «Use-case Ernie #3: Enterprise API для клиента на китайском рынке»

Задача: российская компания делает продукт для китайского клиента, нужна интеграция с локальным AI.

Стек:

  • Baidu AI Cloud через китайское юрлицо или партнёра.
  • API ERNIE 5.0 или ERNIE 4.5 Turbo.
  • Оплата через юаневый счёт.

Почему Ernie: для китайского клиента Baidu — знакомый бренд, вопросов «а что за модель?» не возникнет. Плюс интеграция с Baidu Search / Baidu Maps может быть частью value proposition.

Что такое 01.AI и кто её основал? 01.AI (零一万物, Beijing Lingyi Wanwu Intelligence Technology) — китайская AI-компания, основана в мае 2023 года Kai-Fu Lee (李开复). Достигла статуса unicorn за 6 месяцев. Специализируется на foundation-моделях Yi и enterprise-платформе TrueNorth AI.

Кто такой Kai-Fu Lee? Тайваньско-американский компьютерный учёный. Работал в Apple, Microsoft (президент-основатель Microsoft Research Asia), Google (президент Google Greater China). В 2009 основал венчурный фонд Sinovation Ventures. В мае 2023 запустил 01.AI.

Что такое Yi и почему это важно? Yi (仪) — семейство foundation-моделей от 01.AI. Открытые под Apache 2.0, bilingual (английский + китайский), доступны в размерах от 6B до 100B (Yi-Lightning). Важны как одна из ключевых open-source линеек с китайскими корнями и академической родословной.

Yi открыта под какой лицензией? Apache License 2.0. Разрешено коммерческое использование (GitHub 01-ai/Yi, проверено 02.08.2026).

Какой самый большой контекст у Yi? 200,000 токенов — у моделей Yi-6B-200K и Yi-34B-200K. Это соответствует примерно 400 тысяч китайских символов или 150 тысяч английских слов.

Могу ли я запустить Yi локально? Да. Yi-1.5-6B поместится на MacBook или на потребительскую GPU 12–16 GB. Yi-1.5-9B — на RTX 4090 24 GB. Yi-1.5-34B — на 2× A100 или на 1× RTX 4090 с 4-bit квантизацией.

Что такое Ernie и кто её сделал? ERNIE (Enhanced Representation through Knowledge Integration, по-китайски 文心 Wenxin) — семейство языковых моделей от Baidu, крупнейшего китайского поисковика. Первая версия ERNIE 1.0 вышла в 2019 году. Актуальный флагман — ERNIE 5.0 (2026).

Какая актуальная версия Ernie в 2026? ERNIE 5.0 — мультимодальный флагман с deep reasoning и 119K контекстом. ERNIE X1.1 — reasoning-модель. ERNIE 4.5 Turbo — рабочая лошадка (cloud.baidu.com/product/wenxinworkshop, проверено 02.08.2026).

ERNIE 4.5 open-source — что это значит? В июне 2025 Baidu открыла всё семейство ERNIE 4.5 (10 моделей от 0.3B dense до 300B MoE) под Apache 2.0. Веса, inference-код и тулинг ERNIEKit / FastDeploy доступны публично (GitHub PaddlePaddle/ERNIE, проверено 02.08.2026).

Могу ли я зарегистрироваться в ERNIE Bot из России? Формально нужен китайский номер телефона (+86). Через VoIP-сервисы или посредников — можно, но нестабильно. Оплата подписки требует китайскую платёжную систему (WeChat Pay, Alipay, банковская карта китайского банка).

Yi или Ernie для русскоязычного разработчика? Yi — проще: открытая модель на Hugging Face, никаких региональных барьеров. Ernie — сложнее: enterprise-платформа завязана на китайское юрлицо, потребительский чат требует китайский номер. Для повседневных задач выгоднее DeepSeek, Qwen или Kimi.

Yi-Lightning всё ещё лучшая модель 01.AI? На момент релиза (октябрь 2024) Yi-Lightning занимала 6-е место в мире на LMSYS Arena. В 2026 лидерборд обновился: свежие DeepSeek V3, Qwen 3, GLM-4.6, Kimi K1.5 обошли Yi-Lightning по большинству метрик. Yi-Lightning остаётся сильной моделью, но не SOTA.

Что такое PaddlePaddle и как связан с ERNIE? PaddlePaddle (飞桨) — open-source deep-learning фреймворк от Baidu, аналог PyTorch/TensorFlow. Запущен в 2016 году. ERNIE изначально была построена на PaddlePaddle. В open-source релизе ERNIE 4.5 поддерживаются и PaddlePaddle, и PyTorch (-PT варианты моделей).

Куда идут 01.AI и Baidu стратегически в 2026? 01.AI сфокусирована на enterprise-платформе TrueNorth AI и «AI-советниках» для CEO, инвесторов, sales. Foundation-модели становятся частью более широкой продуктовой стратегии. Baidu продолжает наращивать флагман (ERNIE 5.0), интегрировать AI в свои сервисы (Baidu Search, Maps, Netdisk) и держать open-source семейство ERNIE 4.5 для комьюнити.

Какая экономика у Yi-Lightning vs OpenAI GPT? Точных цен на Yi-Lightning в валюте и токенах в открытых источниках на 02.08.2026 нет (портал platform.lingyiwanwu.com — китаецентричный). Известно, что 01.AI позиционирует Yi-Lightning как модель с competitive pricing для азиатского рынка. Для международных сравнений выгоднее взять DeepSeek V3 или GLM-4.6.

Могу ли я использовать Yi или Ernie для коммерческого продукта? Да, обе линейки open-source под Apache 2.0 разрешают коммерческое использование. Веса можно скачать, развернуть у себя, продавать доступ через свой продукт. Соблюдайте требования Apache 2.0 (сохранение copyright, disclaimer).

Проверено 02.08.2026:

Актуально на 02.08.2026. Модели, цены и условия доступа меняются часто. Перед бизнес-решением всегда сверяйся с первоисточником — все ссылки в разделе Sources выше.