Перейти к содержимому

Какие LLM работают из России напрямую: полная карта 2026

Автор: Silvana · Дата: 30.07.2026 · Verified: 30.07.2026 · Reading time: 6 минут · Prerequisite: 011

  • Из РФ напрямую в браузере, без каких-либо ухищрений, работают: YandexGPT (веб-чат, Алиса, Поиск с Нейро, API через Yandex Cloud), GigaChat (giga.chat, developers.sber.ru), DeepSeek (deepseek.com), Mistral Le Chat (chat.mistral.ai), HuggingChat (huggingface.co/chat).
  • Локально на своём железе работает всё, у чего опубликованы веса: Llama, Qwen, DeepSeek-R1, Gemma 3, Mistral, Phi 4 — через Ollama и LM Studio.
  • Требуют зарубежной регистрации: Claude (claude.ai), ChatGPT (chatgpt.com), Gemini (gemini.google.com). Google явно указывает Россию как неподдерживаемый регион в документации Gemini API.
  • Агрегаторы: OpenRouter, HuggingChat — доступ к десяткам моделей из одного окна, но с зарубежной регистрацией и оплатой.
  • Ландшафт меняется быстро. Проверяйте перед оплатой годовой подписки.

У пользователя из РФ два вопроса, когда речь заходит про AI. Первый — что вообще работает «просто открыть в браузере и пользоваться». Второй — где нужна отдельная подготовка, зарубежная карта и почта, а где не нужна.

Отвечаю картой. Разбил модели на три группы:

  1. Российские сервисы, которые работают напрямую и принимают карты РФ.
  2. Открытые модели, которые запускаются локально и работают всегда — от них не зависит ни один сервер вендора.
  3. Международные сервисы, для которых потребуется зарубежная регистрация и зарубежные средства оплаты.

Отдельно — агрегаторы: сервисы, которые дают доступ сразу к десяткам моделей через один аккаунт.

Все ссылки и характеристики — на 30 июля 2026 года.

Веб-портал: ya.ru/ai (публичная страница про AI-продукты Яндекса). Через веб YandexGPT доступен в Алисе (alice.yandex.ru), в Поиске с Нейро (ya.ru), в Яндекс Браузере (генерация и суммаризация). API — через Yandex Cloud.

Что есть:

  • Alice AI — семейство моделей, запущенное в 2025: Alice AI LLM (текст), Alice AI VLM (vision-language), Alice AI ART (генерация изображений и видео).
  • YandexGPT — модели, отвечающие в Алисе и Поиске с Нейро, доработка текстов в Браузере.
  • YandexART — генерация изображений и видео, встроенная в приложения и сервисы Яндекса.
  • Интеграция во внешние проекты — через Yandex Cloud, отдельный договор и рублёвая оплата.

Регистрация — обычным Яндекс-аккаунтом. Оплата корпоративного и API-доступа — рублями, чек и договор.

Веб-чат: giga.chat. Официальный портал разработчика: developers.sber.ru/portal/products/gigachat.

Линейка (лето 2026):

  • GigaChat 2: Lite / Pro / Max — три уровня качества/цены.
  • GigaChat 3 Ultra — новое поколение, доступное во freemium-версии для физлиц через giga.chat.

Регистрация — по Сбер ID. Оплата подписки для физлиц — рублями, для юрлиц — по договору с чеком. Работает из РФ без ограничений.

Подробное сравнение YandexGPT и GigaChat — вYandexGPT vs GigaChat.

  • Alice AI — часть экосистемы Яндекса, работает во всех продуктах, где встречается Алиса.
  • T-Bank AI — тоже присутствует на рынке, но публичного отдельного веб-чата уровня «зашёл и пользуешься» на 30.07.2026 не предоставляет; сервис поставляет свои модели в собственные продукты банка.

Модели, у которых веса скачиваются с huggingface.co или ollama.com/library. После загрузки — работают на твоём железе, без интернета. Никакой географии, никаких блокировок в принципе: локальный процесс не отправляет запросы наружу.

ollama.com. CLI-инструмент, ставится одной командой на macOS/Linux/Windows. После установки:

ollama run llama3.1
ollama run qwen2.5
ollama run deepseek-r1

В библиотеке — Llama 3.1 (8B/70B/405B от Meta), Qwen 2.5 (0.5B–72B от Alibaba), DeepSeek-R1, Gemma 3 (Google, с vision), Mistral 7B, Phi 4 (Microsoft). Плюс отдельные семейства для кода: Qwen2.5-Coder, DeepSeek-Coder. Vision-модели: LLaVA, Qwen3-VL. Всего больше пятисот моделей разных размеров.

Ollama поднимает локальный REST API на localhost:11434— к нему можно подключить любое приложение вроде OpenWebUI, LibreChat, TypingMind.

lmstudio.ai. Десктоп-приложение с графическим интерфейсом. Ставится, скачивает модель через встроенный каталог, запускает чат в окне. Для тех, кому не нужна командная строка.

vllm.ai. Production-инференс: раздача одной модели тысячам запросов в секунду. Ставится на сервер с GPU, поднимает совместимый с OpenAI API endpoint. Нужен для собственных чат-ботов и внутрикорпоративных ассистентов на своём железе.

Разбор всех трёх стеков и требований по железу — влокальные LLM.

Международные LLM (требуют зарубежной регистрации)

Заголовок раздела «Международные LLM (требуют зарубежной регистрации)»

Веб-интерфейс claude.ai регистрирует пользователей с зарубежным номером телефона и в поддерживаемой стране. Из РФ — регистрация не проходит.

API-ключи Anthropic технически работают из любой точки мира (сервер проверяет ключ, не географию), но получить их и оплатить нужно через зарубежный аккаунт и зарубежную карту либо через посредника. Разбор оплаты — вкак оплачивать AI-подписки из РФ.

Актуальная линейка (июль 2026): Claude Fable 5, Mythos 5, Opus 5, Sonnet 5, Haiku 4.5. Контекст до 1 000 000 токенов у старших моделей. Подробнее — вBig-3 LLM.

Веб-интерфейс chatgpt.com. OpenAI ведёт закрытый список поддерживаемых стран и обслуживает только их. Регистрация с российского номера в веб-интерфейсе на 30.07.2026 не проходит.

API OpenAI технически отдаёт ответы по ключу, но получить и оплатить его нужно с зарубежного аккаунта и карты.

Актуальное семейство: GPT-5.6 (Sol, Terra, Luna), плюс специализированные GPT Image 2 для картинок, GPT-Realtime-2.1 для голоса.

Веб-интерфейс gemini.google.com. Google явно перечисляет поддерживаемые регионы для Gemini API и AI Studio на ai.google.dev/gemini-api/docs/available-regions. Россия в этот список не входит. Тем, кто вне поддерживаемых регионов, документация Google предлагает Gemini Enterprise Agent Platform как альтернативу.

Оплата API — только карты выпущенные в поддерживаемых странах.

Актуальные модели (июль 2026): Gemini 3.6 Flash, 3.5 Flash, 3.5 Flash-Lite, 3.1 Flash-Lite (stable); Gemini 3.1 Pro, 3 Flash, 3.5 Live Translate, 3.1 Flash Live/TTS, Gemini Omni Flash (preview). Плюс семейство Nano Banana для генерации картинок.

openrouter.ai. Один аккаунт — доступ к сотням моделей десятков вендоров: Anthropic, OpenAI, Google, Meta, Mistral, DeepSeek, Qwen, Cohere и другие. Одна платёжка вместо десяти. Свой rate limit и биллинг в кредитах.

Регистрация — email плюс верификация. Пополнение баланса — банковской картой (реквизиты платёжной системы обычные международные), плюс есть криптовалюта. Для пользователя из РФ практический путь оплаты — зарубежная карта либо крипто-пополнение.

huggingface.co/chat. Полностью бесплатный чат от Hugging Face поверх 129+ open-source моделей. Есть Omni Model Router — сервис сам выбирает подходящую модель под запрос. Из последних релизов — Kimi K3 (Moonshot, MoE-модель на 2.8T параметров, контекст 1M токенов, встроенный vision).

Регистрация — email на huggingface.co. Работает без ограничений на использование в РФ, оплата не требуется (сервис бесплатный).

  1. Зайди на alice.yandex.ru через Яндекс-аккаунт — Alice AI откроется сразу, любой запрос обрабатывается YandexGPT.
  2. Отдельно — открой ya.ru, введи запрос со значком «Нейро» в поисковой строке. Ответ с ссылками на источники — это Поиск с Нейро на базе YandexGPT.
  3. Зайди на giga.chat, авторизуйся через Сбер ID. Готово, GigaChat 3 Ultra доступен во freemium.
  4. Сравни ответ обеих моделей на одном и том же реальном рабочем вопросе. Какая точнее — с той и работай дальше.

Поставить Ollama и запустить локальную Qwen за 15 минут

Заголовок раздела «Поставить Ollama и запустить локальную Qwen за 15 минут»
  1. Открой ollama.com/download, скачай установщик под свою ОС.
  2. Установи. После установки Ollama работает как фоновый сервис.
  3. В терминале:
ollama pull qwen2.5:7b
ollama run qwen2.5:7b

Первая команда скачает модель (~5 ГБ). Вторая запустит чат прямо в терминале. Никакого интернета не потребуется после скачивания.

  1. Если нужен графический интерфейс — доставь OpenWebUI (open-webui.com) поверх Ollama, получишь чат в браузере на localhost.

Требования по железу для Qwen 2.5 7B: 16 ГБ RAM и любой современный процессор. Ноутбук справится. Для 70B-моделей нужна видеокарта на 48+ ГБ VRAM или Mac Studio с общей памятью. Подробнее —локальные LLM.

Актуально на 30.07.2026. Правила доступа, поддерживаемые регионы, санкционные ограничения и коммерческие условия у всех вендоров меняются часто. Перед бизнес-решением, оплатой годовой подписки или переносом продакшна на конкретную модель — сверься с первоисточником по ссылкам выше.