0Pricing

OmniRoute: 29,144 Yıldızlı Ücretsiz AI Gateway — Tek Endpoint ile 250+ Provider, %95 Token Tasarrufu

GitHub'da 29,144 yıldız kazanan OmniRoute, 250+ AI provider'ı tek endpoint'te birleştiriyor. RTK+Caveman compression ile %95 token tasarrufu, 4-tier auto-fallback, 18 routing stratejisi. Claude Code, Cursor, Copilot ile uyumlu.

C
CoddyKit Team · 6 min read · 1,248 words
OmniRoute: 29,144 Yıldızlı Ücretsiz AI Gateway — Tek Endpoint ile 250+ Provider, %95 Token Tasarrufu

OmniRoute: 29,144 Yıldızlı Ücretsiz AI Gateway — Tek Endpoint ile 250+ Provider, %95 Token Tasarrufu

AI coding tools kullanırken rate limit'e takılmak, pahalı API faturaları görmek ve farklı provider'lar arasında context switch yapmak sinir bozucu. OmniRoute bu sorunları kökten çözüyor: 250+ AI provider'ı tek bir OpenAI-compatible endpoint arkasında birleştiriyor, otomatik fallback ile asla durmamanızı sağlıyor ve RTK+Caveman compression ile %15-95 token tasarrufu sunuyor.

Bugün GitHub Trending'de 1,841 yeni yıldız ile yükselen OmniRoute, sadece 5 ayda 29,144 yıldıza ulaştı. Neden bu kadar popüler? Çünkü AI development'ın en can yakıcı problemlerini çözüyor.

Problem: AI Gateway Neden Gerekli?

Claude Code, Cursor, Copilot, Codex gibi AI coding tools kullandığınızda şu sorunlarla karşılaşırsınız:

1. Rate Limit Cehennemi

  • Claude Pro: Günde ~100 mesaj limiti
  • OpenAI: Dakikada 60 request
  • Her provider'ın kendi quota sistemi
  • Kritik bir debugging session ortasında "rate limit exceeded" görmek

2. Token Maliyeti

  • Tool output'ları (git diff, grep, loglar) binlerce token yakar
  • Her request'te aynı context'i tekrar göndermek
  • Büyük codebase'lerde context window limitlerine takılmak

3. Provider Fragmentasyonu

  • Claude Code → Anthropic API
  • Cursor → OpenAI + Anthropic
  • Copilot → GitHub + OpenAI
  • Her biri için ayrı API key, ayrı billing, ayrı dashboard

4. Subscription İsrafı

  • Claude Pro kullanmadığınız günlerde quota boşa gider
  • Birden fazla subscription arasında load balancing yok
  • Aylık $20-50/provider, ama optimal kullanım yok

OmniRoute'un çözümü: Tek endpoint, akıllı routing, otomatik optimizasyon.

Mimari: Nasıl Çalışıyor?

1. OpenAI-Compatible Proxy

OmniRoute, localhost:20128/v1 üzerinde OpenAI API-compatible bir proxy çalıştırır:

# Kurulum
npm install -g omniroute
omniroute start

# Kullanım — herhangi bir OpenAI client ile
curl http://localhost:20128/v1/chat/completions \
  -H "Content-Type: application/json" \
  -d '{
    "model": "auto",
    "messages": [{"role": "user", "content": "Hello!"}]
  }'

Claude Code, Cursor, Copilot — hepsi OpenAI formatını konuşur. OmniRoute bu request'i alır, optimal provider'a yönlendirir, response'u OpenAI formatına çevirir. Sizin hiçbir şey değiştirmenize gerek yok.

2. 4-Tier Auto-Fallback

OmniRoute, request'leri 4 katmanlı bir cascade'de yönlendirir:

┌─────────────────────────────────────────────────────────┐
│  Your IDE / CLI (Claude Code, Cursor, Cline, Copilot)   │
└──────────────────────┬──────────────────────────────────┘
                       │ http://localhost:20128/v1
                       ▼
┌─────────────────────────────────────────────────────────┐
│              OmniRoute — Smart Router                    │
│  RTK + Caveman compression · 18 routing strategies       │
│  Circuit breakers · TLS stealth · MCP · A2A              │
└──────────────────────┬──────────────────────────────────┘
       ┌───────────┬───┴────────┬───────────┐
       ▼ Tier 1    ▼ Tier 2     ▼ Tier 3    ▼ Tier 4
  SUBSCRIPTION   API KEY       CHEAP        FREE
  Claude Pro,    DeepSeek,     GLM $0.5,    Kiro, Qoder,
  Codex, Copilot Groq, xAI     MiniMax $0.2 Pollinations
  quota out? ──▶ budget hit? ─▶ hit? ──────▶ always on

Senaryo: Claude Pro ile kod yazıyorsunuz, quota doldu → OmniRoute otomatik olarak DeepSeek API'ye geçer → DeepSeek bütçesi bitti → GLM-4'e düşer → o da bitti → ücretsiz Pollinations AI devreye girer. Siz hiçbir şey fark etmezsiniz.

3. 18 Routing Strategy

OmniRoute, 18 farklı routing stratejisi sunar. auto mode'da 12-factor live scoring ile en uygun provider'ı seçer:

Model ID Optimizasyon
auto 🎯 Dengeli (Last-Known-Good-Provider)
auto/coding 🧑‍💻 Kod kalitesi öncelikli
auto/fast ⚡ En düşük latency
auto/cheap 💰 Token başına en ucuz
auto/offline 🔋 En yüksek quota headroom
auto/smart 🔭 Kalite + %10 exploration

Manuel stratejiler:

# Örnek: Priority-based fallback
strategy: priority
targets:
  - model: claude-3-5-sonnet
    tier: subscription
  - model: deepseek-chat
    tier: api
  - model: glm-4-flash
    tier: cheap
  - model: pollinations
    tier: free

Diğer stratejiler: fill-first, weighted, round-robin, p2c (power-of-two-choices), least-used, cost-optimized, headroom, reset-window, context-relay, fusion (multi-model panel + judge), pipeline (chained steps).

RTK + Caveman Compression: %95 Token Tasarrufu

OmniRoute'un en etkileyici özelliği: RTK (Real-Time Kompresyon) + Caveman stacked compression.

Problem: Tool Output'lar Neden Bu Kadar Büyük?

Claude Code veya Cursor, git diff veya grep çalıştırdığında output binlerce token olabilir:

$ git diff | wc -c
45,892 bytes (~11,473 tokens)

Bu output'un çoğu AI için gereksiz: boş satırlar, tekrar eden context, verbose log formatları.

Çözüm: İki Aşamalı Kompresyon

1. RTK (Real-Time Kompresyon)

  • Tokenization-aware compression
  • Semantic redundancy detection
  • Incremental diff encoding

2. Caveman

  • Tool output'ları minimal formata dönüştürür
  • Gereksiz whitespace, comments, boilerplate'ı kaldırır
  • Structured data'yı compact representation'a çevirir

Sonuç: Tool-heavy session'larda ortalama %89 token azaltması, bazı durumlarda %95'e kadar.

Önce:  11,473 tokens (git diff)
       ↓ RTK + Caveman
Sonra:  574 tokens (compressed)
Tasarruf: 95%

Bu, özellikle büyük codebase'lerde ve uzun debugging session'larında devrim niteliğinde.

250+ Provider, 90+ Ücretsiz

OmniRoute, 250+ AI provider'ı destekler. Bunların 90+ tanesi ücretsiz tier sunar:

Ücretsiz Provider'lar (örnekler):

  • Kimi (Moonshot AI) — K2, K3 modelleri, 1M token context
  • Pollinations AI — Sınırsız ücretsiz inference
  • Qoder — Coding-optimized, free tier
  • Kiro — Amazon'un AI coding tool'u
  • LongCat — Long-context models
  • SiliconFlow — Permanently free, no cap
  • Z.AI GLM-Flash — Zhipu AI'nin hızlı modeli

Toplam ücretsiz quota: ~1.6B tokens/ay (steady state), ilk ay ~2.1B tokens (signup credits dahil).

Provider Pool Aggregation

OmniRoute, aynı modelin farklı provider'lardaki ücretsiz quota'larını pool olarak birleştirir:

# Claude 3.5 Sonnet — 5 farklı provider
providers:
  - name: "Claude Code (Anthropic)"
    free_tier: "100 messages/day"
  - name: "OpenRouter"
    free_tier: "$10 credit"
  - name: "Kimi Code"
    free_tier: "500K tokens/day"
  - name: "Qoder"
    free_tier: "1M tokens/month"
  - name: "Cline"
    free_tier: "200 requests/day"

# Toplam: ~15M tokens/day Claude 3.5 Sonnet

OmniRoute bu pool'ları otomatik yönetir, quota'ları track eder, optimal provider'ı seçer.

MCP + A2A: AI Agent Ecosystem

OmniRoute sadece bir proxy değil — MCP (Model Context Protocol) ve A2A (Agent-to-Agent) desteği ile tam bir AI agent platform'u.

MCP Server

94 built-in MCP tool:

{
  "tools": [
    "file_read",
    "file_write",
    "shell_exec",
    "git_status",
    "grep_search",
    "code_parse",
    "web_fetch",
    "database_query",
    // ... 86 more
  ]
}

Claude Code, Cursor, Cline gibi MCP-supporting tools, OmniRoute üzerinden bu tool'lara erişebilir.

A2A (Agent-to-Agent)

Birden fazla AI agent'ı orchestrate edin:

# Agent A: Code review
# Agent B: Test generation
# Agent C: Documentation

# OmniRoute A2A ile hepsi aynı context'i paylaşır

Kurulum ve Kullanım

1. npm ile (en kolay)

npm install -g omniroute
omniroute start

# Dashboard: http://localhost:20128
# API: http://localhost:20128/v1

2. Docker ile

docker run -d \
  --name omniroute \
  -p 20128:20128 \
  diegosouzapw/omniroute:latest

3. Desktop App (Electron)

omniroute.online → Download → Install → Start.

Claude Code ile Kullanım

# Claude Code config'e ekle
export ANTHROPIC_BASE_URL=http://localhost:20128/v1
export ANTHROPIC_API_KEY=anything  # OmniRoute handle eder

claude

Cursor ile Kullanım

Settings → Models → Custom → http://localhost:20128/v1 → Model: auto.

Dashboard ve Monitoring

OmniRoute, gerçek zamanlı bir dashboard sunar:

Metrics:

  • Request success rate
  • Provider health status
  • Token usage (per provider, per model)
  • Cost breakdown
  • Latency percentiles (p50, p95, p99)
  • Quota remaining (per provider)

Free Tier Tracker: /dashboard/free-tiers — tüm ücretsiz provider'ların remaining quota'larını gösterir.

Performance ve Reliability

  • 21,000+ tests — comprehensive test coverage
  • Circuit breakers — failing provider'ları otomatik devre dışı bırakır
  • TLS stealth — AI provider'ların geo-block'larını bypass eder
  • Connection pooling — low-latency request handling
  • Caching — repeated request'ler için response cache

Kim Kullanıyor?

OmniRoute, 500+ contributor tarafından geliştiriliyor ve binlerce developer tarafından kullanılıyor:

  • Solo developers — ücretsiz AI coding tools için
  • Startups — API maliyetlerini optimize etmek için
  • Enterprise teams — multi-provider orchestration için
  • AI researchers — model comparison ve benchmarking için

Sonuç: Neden OmniRoute?

OmniRoute, AI development'ın en can yakıcı problemlerini çözüyor:

Asla durma — 4-tier auto-fallback ile sürekli çalışma
%95 tasarruf — RTK+Caveman compression ile token maliyetini minimize et
Tek endpoint — tüm AI tool'larınızı tek bir yerde birleştirin
250+ provider — en geniş provider desteği
Ücretsiz başla — 90+ free tier, $0 upfront cost
Production-grade — circuit breakers, monitoring, 21K+ tests

Eğer AI coding tools kullanıyorsanız ve rate limit, maliyet, provider fragmentation sorunları yaşıyorsanız, OmniRoute kesinlikle denemeye değer.

Kaynaklar


AI development, AI agents ve LLM integration hakkında daha fazla içerik için CoddyKit AI Agents Kursu ve AI with Python Kursu'nu inceleyebilirsiniz. TypeScript ile AI tool development için TypeScript Kursu da faydalı olabilir.

Tüm kurslarımız için: coddykit.com/courses

ProgrammingTutorialCoddyKit

Enjoyed this article?

Explore more tutorials and insights to level up your coding skills.

Browse All Articles →