Бесплатные LLM-провайдеры для Cline и Roo Code
Коротко
Из России без карты и VPN надёжнее всего заводятся три варианта. Первый — OpenRouter: бесплатный слой даёт 20 запросов в минуту и 50 в сутки, а после разовой покупки кредитов на 10 $ суточный лимит поднимается до 1000. Второй — Groq: свой бесплатный слой с лимитами на каждую модель, например 30 запросов в минуту и 14,4 тыс. в сутки для llama-3.1-8b-instant; как получить ключ, разобрано отдельно в статье про Groq из России. Третий — Ollama на своей машине: лимитов нет вообще, платите только железом.
Ключевой фильтр при выборе модели — поддержка вызова инструментов (tools): Roo Code работает только через нативный tool calling, и модель без него просто не сможет читать и править файлы. Из 367 моделей в каталоге OpenRouter на 28 июля 2026 бесплатных 14, и 13 из них умеют tools — выбирать есть из чего, но проверять надо каждую.
Google AI Studio, OpenAI и Anthropic напрямую не рассматривайте: их API в России не обслуживается.
Зачем это нужно
Cline и Roo Code — расширения VS Code, которые сами не содержат модели: вы приносите свой ключ, они гоняют через него агентский цикл. Отсюда и главная боль: половина англоязычных гайдов рекомендует провайдеров, которые из России просто не открываются, а вторая половина молчит про то, чем за них платить.
Разница между «модель отвечает в чате» и «модель работает агентом» тут принципиальная. Агенту нужно вызывать инструменты: прочитать файл, записать файл, выполнить команду. В документации Roo Code сказано прямо: «Roo Code uses native tool calling exclusively. This is the only supported tool protocol — there is no XML-based fallback». Модель без поддержки tools в Roo Code бесполезна, сколько бы она ни стоила. Cline в этом чуть мягче, но и там дешёвая модель без tools превращается в генератор советов вместо исполнителя.
Второй фильтр — контекст. Агент за один шаг отправляет системный промпт, список файлов, содержимое открытых файлов и историю. 8–16 тысяч токенов кончаются на третьем сообщении. Ниже 64k брать смысла мало.
Готовый пример целиком
Вот сравнение того, что реально доступно, с проверяемыми цифрами на июль 2026.
| Провайдер | Бесплатный слой | Чем платить дальше | Главный подвох |
|---|---|---|---|
| OpenRouter | 20 запросов/мин, 50/сутки; 1000/сутки после разовой покупки кредитов на 10 $ | Кредиты картой или через Coinbase-чекаут | Российской картой пополнение не пройдёт; часть провайдеров внутри маршрутизатора сама режет регионы |
| Groq | Лимиты на каждую модель: 30 req/min и 14,4K req/day для llama-3.1-8b-instant, 30 req/min и 1K req/day для llama-3.3-70b-versatile |
План Developer | Лимит по токенам кончается раньше лимита по запросам: 6K TPM для 8b-модели — это буквально несколько ходов агента |
| Ollama (локально) | Без лимитов | Только железо | Контекст по умолчанию 4096 токенов — агент захлебнётся на первом же файле |
| Yandex AI Studio | Нет, оплата по факту | Рублями, счёт российского юрлица | Своя схема идентификатора модели: gpt://<каталог>/<модель>/latest |
| Z.AI (GLM) | Нет бесплатного слоя | Подписка GLM Coding Plan, оплата зарубежной картой | Отдельные регионы (International / China) с разными ключами и ценами |
Минимальный рабочий сетап, который заводится за десять минут:
Cline + OpenRouter. Настройки Cline → API Provider: OpenRouter → вставить ключ в поле OpenRouter API Key → выбрать модель из списка. Берите модель с суффиксом :free и поддержкой tools, например openai/gpt-oss-20b:free (131k контекста).
Roo Code + любой OpenAI-совместимый эндпоинт. Провайдер OpenAI Compatible, три поля: Base URL, API Key, Model ID. Для OpenRouter Base URL — https://openrouter.ai/api/v1. Для Yandex AI Studio — https://ai.api.cloud.yandex.net/v1, а Model ID в формате gpt://<идентификатор_каталога>/<идентификатор_модели>/latest.
Continue + локальная модель. В config.yaml:
name: local
version: 0.0.1
schema: v1
models:
- name: qwen3-coder
provider: openai
model: qwen3-coder:30b
apiBase: http://localhost:11434/v1
apiKey: ollama
И перед этим — ollama pull qwen3-coder:30b, у неё в каталоге стоит метка tools.
Разбор по частям
Как проверить, что модель вообще годится в агенты. Не верьте обзорам, спросите каталог. Одна команда — и вы видите все бесплатные модели OpenRouter с поддержкой инструментов:
curl -s https://openrouter.ai/api/v1/models \
| python3 -c "import sys,json;[print(m['id'],m['context_length']) for m in json.load(sys.stdin)['data'] if m['id'].endswith(':free') and 'tools' in (m.get('supported_parameters') or [])]"
На 28 июля 2026 этот запрос отдаёт 13 моделей из 14 бесплатных. Список меняется каждый месяц, поэтому команду лучше сохранить, чем запоминать конкретные названия.
Почему бесплатный слой кончается быстрее, чем кажется. Агентский шаг — это не один запрос. Прочитать файл, подумать, записать, проверить diff — четыре обращения к модели. При лимите 50 запросов в сутки у OpenRouter это примерно десяток осмысленных правок. У Groq лимит по токенам в минуту бьёт ещё раньше: 6000 TPM для восьмимиллиардной модели — один большой файл в контексте, и вы в ожидании.
Локальный вариант — единственный без потолка. Но два условия. Первое: память. Тридцатимиллиардная модель в 4-битной квантизации требует примерно 20 ГБ, комфортно — от 32 ГБ RAM или видеокарта с 24 ГБ. Второе: контекст. По документации Ollama окно по умолчанию — 4096 токенов, и агент в нём не живёт. Поднимайте до разумного:
OLLAMA_CONTEXT_LENGTH=65536 ollama serve
Карточки инструментов с актуальными ссылками — в арсенале: Cline, Roo Code, OpenRouter и Ollama.
Чего в него класть не надо
Google AI Studio и Gemini API. Официальный список стран, где доступны Gemini API и AI Studio, Россию не включает. Ключ, полученный обходным путём, живёт до первой проверки.
Прямые ключи OpenAI и Anthropic. Те же грабли плюс оплата: карта российского банка не пройдёт, а покупка ключа у перекупщиков — это чужой аккаунт, который отключат вместе с вашим проектом.
Модели без tools. В списке бесплатных попадаются специализированные — например, модели-классификаторы контент-фильтрации. Они в агентском режиме бесполезны: подключаются, отвечают, но ничего не делают.
Крошечные локальные модели. 3B и 7B на бумаге запускаются на ноутбуке, на практике в агентском цикле уходят в бесконечный ремонт собственных ошибок. Для автодополнения — да, для Cline и Roo Code — нет.
Все ключи в одном месте. Ключ, вписанный в config.yaml и закоммиченный в репозиторий, — самая частая утечка среди тех, кто настраивает это впервые. В Cline и Roo Code ключи хранятся в настройках расширения, в Continue — выносите их в переменные окружения.
Как поддерживать в актуальном виде
Список бесплатных моделей у OpenRouter обновляется постоянно: модели приходят, уходят и теряют бесплатный статус без предупреждения. Раз в месяц прогоняйте команду выше и сверяйте, жива ли ваша.
Держите второго провайдера настроенным заранее. У Cline и Roo Code профили переключаются в один клик, и когда основной ключ упрётся в лимит посреди задачи, вы просто смените профиль, а не пойдёте заводить аккаунт.
Не строите рабочие процессы вокруг конкретной бесплатной модели. Бесплатный слой у любого зарубежного провайдера — маркетинговая витрина, а не обязательство: правила меняются, регионы блокируются, лимиты режутся. Рабочая схема на длинную дистанцию — бесплатный слой для экспериментов, локальная модель как страховка и один платный канал с понятной оплатой для того, что приносит деньги.
Частые вопросы
Какой провайдер подключить к Roo Code, чтобы работал из России?
По убыванию надёжности: локальная Ollama (не зависит ни от чьих ограничений), затем Yandex AI Studio через профиль OpenAI Compatible (рублёвая оплата, российское юрлицо), затем OpenRouter — сам он страновых ограничений в условиях не устанавливает, но оговаривает, что отдельные провайдеры моделей могут не разрешать доступ из некоторых стран или регионов. Проверяется это ровно одним способом: получить ключ и отправить тестовый запрос.
Правда ли можно работать полностью бесплатно?
Да, но с оговорками. Бесплатного слоя OpenRouter или Groq хватает на учёбу, мелкие правки и разовые задачи. На полный рабочий день агентского кодинга — нет: упрётесь либо в суточный лимит запросов, либо в токены в минуту. Полностью без потолка работает только локальная модель, и её потолок — ваше железо и терпение.
Почему модель подключилась, а Cline или Roo Code не редактируют файлы?
В девяти случаях из десяти модель не поддерживает вызов инструментов. Проверьте по каталогу: у модели должен быть параметр tools. Второй по частоте случай — маленькое окно контекста: агент отправляет большой системный промпт, тот не помещается, и провайдер обрезает запрос. Третий — эндпоинт без поддержки стриминга; Roo Code рассчитывает на потоковую отдачу аргументов инструментов.
Нужен ли VPN?
Для локальной модели и российских провайдеров — нет. Для OpenRouter и Groq вопрос решается опытным путём: часть пользователей работает напрямую, часть — нет, и зависит это от вашего провайдера связи и текущей политики сервиса. Помните, что VPN не решает вопрос оплаты: пополнение баланса зарубежной картой всё равно потребует отдельного канала.
Что выбрать, если нужен один вариант и без экспериментов?
Машина с 32 ГБ памяти, ollama pull qwen3-coder:30b, контекст 64k, Cline или Roo Code через OpenAI-совместимый профиль на http://localhost:11434/v1. Медленнее облака, слабее топовых платных моделей, зато не отключится, не подорожает и не потребует карты.