omniroute-free-tier-providers-report

modified: 2026-08-03 12:18 · canonical

OmniRoute: Исследование и Free-Tier Провайдеры 2026

Дата исследования: 30 июля 2026 Версия OmniRoute: 3.8.49+ Endpoint: http://127.0.0.1:20128/v1

---

1. Как добавить провайдера в OmniRoute

Методы добавления провайдера

OmniRoute поддерживает три способа подключения провайдеров:

1.1 Через Dashboard (Web UI)

Dashboard → Providers → Connect Provider

Типы аутентификации:

1.2 Через CLI

# Интерактивное добавление
omniroute provider add

# Тестирование подключения провайдера
omniroute provider test <provider-id>

# Пакетное тестирование всех провайдеров
omniroute providers test-batch

# Список подключённых провайдеров
omniroute provider list

1.3 Через Environment Variables (Headless/CI)

# Пример для Docker/Kubernetes
export INITIAL_PASSWORD="your-secure-password"
export OPENAI_API_KEY="sk-..."
export GEMINI_API_KEY="AIza..."
export GROQ_API_KEY="gsk_..."

omniroute setup --non-interactive

Формат конфигурации провайдера

Провайдеры определяются в src/shared/constants/providers.ts и хранятся в локальной SQLite базе.

Структура провайдера:

ПолеОписаниеПример
idУникальный идентификаторnvidia, gemini, groq
aliasКороткий псевдоним для моделейnv, gemini, groq
nameОтображаемое имяNVIDIA NIM, Gemini (Google AI Studio)
tagsКатегорииAPI key, OAuth, free, aggregator
websiteСсылка на сайтhttps://build.nvidia.com
notesЗаметки о free tier"Free dev access: ~40 RPM, 70+ models"

Примеры добавления провайдеров

NVIDIA NIM (API Key)

Dashboard → Providers → Add Provider → NVIDIA NIM
- Provider ID: nvidia
- API Key: nvapi-xxxxx (получить на build.nvidia.com)
- Base URL: https://integrate.api.nvidia.com/v1 (автоматически)

Модели: nvidia/glm-5.2, nvidia/deepseek-v4-flash, nvidia/qwen-2.5-72b-instruct

Google Gemini (API Key)

Dashboard → Providers → Add Provider → Gemini
- Provider ID: gemini
- API Key: AIza... (получить на aistudio.google.com)
- Base URL: https://generativelanguage.googleapis.com/v1beta/openai (автоматически)

Модели: gemini/gemini-2.5-flash, gemini/gemini-3.1-flash-lite

Groq (API Key)

Dashboard → Providers → Add Provider → Groq
- Provider ID: groq
- API Key: gsk_... (получить на console.groq.com)
- Base URL: https://api.groq.com/openai/v1 (автоматически)

Модели: groq/llama-3.1-8b-instant, groq/llama-3.3-70b-versatile, groq/qwen3-32b

---

2. Актуальные Free-Tier Провайдеры 2026

Сводная таблица

ПровайдерFree TierКредиты/ЛимитыКартаРегистрацияМодели
NVIDIA NIM✅ Да~40 RPM, 70+ моделей❌ Нетbuild.nvidia.comGLM-5.2, DeepSeek V4, Kimi K2.6, Qwen
Google AI Studio✅ Да1,500 RPD (Flash), 50 RPD (2.5 Pro)❌ Нетaistudio.google.comGemini 2.5 Flash, 3 Flash, 3.1 Flash-Lite
Groq✅ Да30 RPM, 14,400 RPD, 30K TPM❌ Нетconsole.groq.comLlama 3.1/3.3/4, Qwen3, DeepSeek R1 Distill
DeepSeek✅ Да5M токенов на регистрацию❌ Нетplatform.deepseek.comDeepSeek V4 Flash/Pro, R1
OpenRouter✅ Да20 RPM, 200 RPD на free модели❌ Нетopenrouter.ai15+ free моделей (Nemotron, Laguna, Ling)
Cohere✅ Да1,000 API calls/month❌ Нетcohere.comCommand A+, Command R+, Rerank 3.5
Mistral✅ Да~1B tokens/month, rate-limited❌ Нетmistral.aiMistral Small/Medium/Large, Codestral
Together AI❌ Нет$5 min purchase (было $25 credit)✅ Даtogether.aiLlama, Qwen, DeepSeek (paid only)
Hugging Face✅ ДаFree Inference API, rate-limited❌ Нетhuggingface.co45,000+ моделей (Whisper, SDXL, etc.)
Cloudflare Workers AI✅ Да10,000 Neurons/day❌ Нетdash.cloudflare.comLlama, Qwen, Mistral, Phi-2

---

3. Детальная информация по провайдерам

3.1 NVIDIA NIM (free-claude-code)

Статус: ✅ Free tier доступен

Регистрация: 1. Перейти на https://build.nvidia.com 2. Нажать "Get API Key" 3. Авторизоваться через NVIDIA аккаунт или Google/GitHub 4. API ключ генерируется автоматически

Free Tier лимиты:

Лучшие модели для кодинга:

МодельКонтекстНазначение
glm-5.2128KОбщий кодинг
deepseek-v4-flash1MБыстрое программирование
kimi-k2.6256KСложные задачи
qwen-2.5-72b-instruct128KМультиязычный код

OmniRoute конфигурация:

{
  "provider": "nvidia",
  "apiKey": "nvapi-xxxxx",
  "models": ["nvidia/glm-5.2", "nvidia/deepseek-v4-flash"]
}

---

3.2 Google AI Studio (Gemini)

Статус: ✅ Free tier доступен (Flash модели)

Регистрация: 1. Перейти на https://aistudio.google.com 2. Войти через Google аккаунт 3. Нажать "Get API Key" 4. Создать новый API ключ

Free Tier лимиты (апрель 2026):

Требования:

OmniRoute конфигурация:

{
  "provider": "gemini",
  "apiKey": "AIza...",
  "models": ["gemini/gemini-2.5-flash", "gemini/gemini-3-flash"]
}

---

3.3 Groq

Статус: ✅ Free tier доступен

Регистрация: 1. Перейти на https://console.groq.com 2. Sign up через Google/GitHub/email 3. API ключ создаётся сразу после регистрации

Free Tier лимиты:

МетрикаЛимит
Requests per Minute (RPM)30
Requests per Day (RPD)14,400
Tokens per Minute (TPM)30,000 (зависит от модели)
Tokens per Day (TPD)500,000

Лучшие модели:

МодельTPMTPSНазначение
llama-3.1-8b-instant6K840Быстрые ответы
llama-3.3-70b-versatile12K394Сложные задачи
llama-4-scout-17b30K600Баланс
qwen3-32b6K500Мультиязычность
deepseek-r1-distill-llama-70bReasoning

Developer Tier (с картой):

OmniRoute конфигурация:

{
  "provider": "groq",
  "apiKey": "gsk_...",
  "models": ["groq/llama-3.3-70b-versatile", "groq/qwen3-32b"]
}

---

3.4 DeepSeek

Статус: ✅ Free tier доступен

Регистрация: 1. Перейти на https://platform.deepseek.com 2. Sign up через email/Google/GitHub 3. Верификация email 4. API ключ в Dashboard

Free Tier:

Цены (после free tier):

МодельInput ($/1M)Output ($/1M)Cache Hit
DeepSeek V4 Flash$0.14$0.28$0.0028
DeepSeek V4 Pro$0.435$0.87$0.0036

Контекст: 1M tokens, 384K max output

OmniRoute конфигурация:

{
  "provider": "deepseek",
  "apiKey": "sk-...",
  "models": ["deepseek/deepseek-chat", "deepseek/deepseek-reasoner"]
}

---

3.5 OpenRouter

Статус: ✅ Free models доступны

Регистрация: 1. Перейти на https://openrouter.ai 2. Sign up через Google/GitHub/email 3. API ключ генерируется автоматически

Free Tier:

Free модели (июль 2026):

МодельКонтекстНазначение
nvidia/nemotron-3-ultra-550b:free262K → 128KReasoning
poolside/laguna-xs-2.1:free256KCoding agent
inclusionai/ling-3.0-flash:freeMultilingual
qwen/qwen3-235b-a22b:freeLarge model
deepseek/deepseek-r1:freeReasoning

⚠️ Важно: Free модели могут быть удалены без предупреждения. За 9 дней до 27 июля 2026 удалено 7 free моделей (Llama, Qwen, Hermes).

OmniRoute конфигурация:

{
  "provider": "openrouter",
  "apiKey": "sk-or-...",
  "models": [
    "openrouter/nvidia/nemotron-3-ultra-550b:free",
    "openrouter/poolside/laguna-xs-2.1:free"
  ]
}

---

3.6 Cohere

Статус: ✅ Free Trial API доступен

Регистрация: 1. Перейти на https://cohere.com 2. Sign up 3. Создать Trial API key

Free Tier (Trial API Key):

МетрикаЛимит
API calls per month1,000
Chat RPM20
Embed RPM5

Модели:

Ограничения:

OmniRoute конфигурация:

{
  "provider": "cohere",
  "apiKey": "...",
  "models": ["cohere/command-a-plus-05-2026", "cohere/command-r-plus"]
}

---

3.7 Mistral AI

Статус: ✅ Free Experiment tier доступен

Регистрация: 1. Перейти на https://mistral.ai 2. Sign up на La Plateforme 3. SMS верификация (иногда) 4. API ключ создаётся автоматически

Free Tier (Experiment):

МетрикаЛимит
Tokens per month~1,000,000,000 (1B)
Global rate limit1 req/sec per API key
Телефон✅ SMS верификация
Карта❌ Не требуется

Модели (все доступны):

Quota pools:

МодельTokens/minReq/minTokens/month
codestral-latest20,000101,000,000,000
mistral-large-latest20,000101,000,000,000
devstral-25121,000,0005010,000,000

OmniRoute конфигурация:

{
  "provider": "mistral",
  "apiKey": "...",
  "models": ["mistral/mistral-large-latest", "mistral/codestral-latest"]
}

---

3.8 Together AI

Статус: ❌ Free tier отменён (июль 2025)

Изменения:

Альтернативы:

Цены (paid):

МодельInput ($/1M)Output ($/1M)
Llama 3.3 70B$1.04$1.04
DeepSeek V4 Pro$2.10$4.40
GLM-5.2$1.40$4.40

---

3.9 Hugging Face

Статус: ✅ Free Inference API доступен

Регистрация: 1. Перейти на https://huggingface.co 2. Sign up 3. Access Token в Settings → Access Tokens

Free Tier:

Модели:

OmniRoute конфигурация:

{
  "provider": "huggingface",
  "apiKey": "hf_...",
  "models": ["huggingface/mistral-7b-instruct"]
}

---

3.10 Cloudflare Workers AI

Статус: ✅ Free tier доступен

Регистрация: 1. Перейти на https://dash.cloudflare.com 2. Создать аккаунт 3. Workers AI → Get Started

Free Tier (Workers Free):

МетрикаЛимит
Neurons per day10,000
Reset00:00 UTC daily
После free tier$0.011 per 1,000 Neurons

Rate Limits:

TaskRPM
Text Generation300
Text Embeddings3,000
Image Classification3,000
Speech Recognition720

Модели:

Требования:

OmniRoute конфигурация:

{
  "provider": "cloudflare-ai",
  "apiKey": "...",
  "accountId": "...",
  "models": ["cf/@cf/meta/llama-3.1-8b-instruct"]
}

---

4. Routing стратегии в OmniRoute

4.1 Типы стратегий

OmniRoute поддерживает 18 routing стратегий:

СтратегияОписание
PriorityВсегда первый в списке, fallback при ошибке
Round-RobinПоследовательная ротация
RandomСлучайный выбор
WeightedПропорциональное распределение по весам
Least-UsedМинимальное количество запросов
Cost-OptimizedСамый дешёвый доступный
FusionПараллельные запросы к нескольким моделям
PipelineПоследовательная обработка

4.2 Auto-Routing

Самый простой способ — использовать модель auto:

# Автоматический выбор модели
curl http://localhost:20128/v1/chat/completions \
  -H "Authorization: Bearer YOUR_KEY" \
  -d '{"model": "auto", "messages": [...]}'

Варианты auto:

4.3 Combos (Fallback Chains)

Создание combo в Dashboard:

Пример: Maximize Subscription + Free Backup

Name: premium-with-free-fallback

Models:
1. cc/claude-opus-4-7 (Claude Pro subscription)
2. nvidia/glm-5.2 (NVIDIA free tier)
3. groq/llama-3.3-70b-versatile (Groq free tier)
4. gemini/gemini-2.5-flash (Google free tier)

Strategy: Priority

Пример: Zero-Cost Combo

Name: free-forever

Models:
1. gemini/gemini-2.5-flash (1,500 RPD free)
2. groq/llama-3.3-70b-versatile (14,400 RPD free)
3. openrouter/poolside/laguna-xs-2.1:free (200 RPD free)
4. nvidia/deepseek-v4-flash (40 RPM free)

Strategy: Round-Robin

4.4 CLI интеграция

Claude Code:

# Автонастройка
omniroute setup-claude-code

# Ручная настройка ~/.claude/config.json
{
  "anthropic_api_base": "http://localhost:20128/v1",
  "anthropic_api_key": "omniroute-api-key"
}

Cursor:

// ~/.cursor/config.json
{
  "aiProvider": {
    "baseUrl": "http://localhost:20128/v1",
    "apiKey": "omniroute-api-key",
    "model": "auto/coding"
  }
}

Codex CLI:

export OPENAI_API_BASE="http://localhost:20128"
export OPENAI_API_KEY="omniroute-api-key"

---

5. Рекомендации по настройке

5.1 Для максимальной бесплатной работы

Combo: Ultimate Free Stack

{
  "name": "ultimate-free",
  "models": [
    {"model": "gemini/gemini-2.5-flash", "priority": 1},
    {"model": "groq/llama-3.3-70b-versatile", "priority": 2},
    {"model": "nvidia/glm-5.2", "priority": 3},
    {"model": "mistral/codestral-latest", "priority": 4},
    {"model": "openrouter/poolside/laguna-xs-2.1:free", "priority": 5}
  ],
  "strategy": "priority"
}

Ожидаемый ежедневный лимит:

Итого: ~160,000+ запросов в день бесплатно

5.2 Для кодинга

Combo: Code Assistant

{
  "name": "code-assistant",
  "models": [
    {"model": "nvidia/glm-5.2", "priority": 1},
    {"model": "groq/llama-3.3-70b-versatile", "priority": 2},
    {"model": "deepseek/deepseek-chat", "priority": 3}
  ],
  "strategy": "auto/coding"
}

5.3 Для быстрого прототипирования

Combo: Speed Demon

{
  "name": "speed-demon",
  "models": [
    {"model": "groq/llama-3.1-8b-instant", "priority": 1},
    {"model": "groq/llama-4-scout-17b", "priority": 2},
    {"model": "gemini/gemini-3-flash", "priority": 3}
  ],
  "strategy": "auto/fast"
}

---

6. Проверка работы OmniRoute

6.1 Health Check

# Проверка статуса
omniroute status

# Диагностика
omniroute doctor

# Список провайдеров
omniroute provider list

6.2 API Test

# Тест модели через OmniRoute
curl http://localhost:20128/v1/chat/completions \
  -H "Authorization: Bearer YOUR_API_KEY" \
  -H "Content-Type: application/json" \
  -d '{
    "model": "auto",
    "messages": [{"role": "user", "content": "Hello, world!"}]
  }'

6.3 Dashboard

Открыть http://localhost:20128 в браузере для:

---

7. Итоговая таблица регистрации

ПровайдерURL регистрацииГде взять ключКартаFree лимиты
NVIDIA NIMbuild.nvidia.comGet API Key → Copy40 RPM, 70+ models
Google AI Studioaistudio.google.comGet API Key1,500 RPD (Flash)
Groqconsole.groq.comAPI Keys → Create30 RPM, 14.4K RPD
DeepSeekplatform.deepseek.comAPI Keys5M tokens
OpenRouteropenrouter.aiSettings → Keys20 RPM (free models)
Coherecohere.comTrial API Key1,000 calls/month
Mistralconsole.mistral.aiAPI Keys1B tokens/month
Hugging Facehuggingface.coSettings → Access TokensRate-limited
Cloudflaredash.cloudflare.comWorkers AI → API Tokens10K Neurons/day

---

Источник данных:

Подготовлено: Hermes Agent Subagent Дата: 30 июля 2026