Deep Dive: Cara Kerja OmniRouter dan 237 AI Providers Gratis di 2026
Back to Blog
Technology July 10, 2026 5 min read

Deep Dive: Cara Kerja OmniRouter dan 237 AI Providers Gratis di 2026

Tutorial lengkap cara kerja OmniRouter sebagai AI gateway gratis — dari setup, konfigurasi provider, routing strategies, hingga token optimization yang hemat 15–95%.

Pendahuluan

Di tahun 2026, akses ke berbagai AI model bukan lagi privilege — tapi kebutuhan. Namun biaya API bisa melonjak cepat jika tidak dikelola dengan baik. OmniRouter hadir sebagai solusi: AI Gateway gratis yang menggabungkan 237 provider AI dengan 90+ provider gratis di dalam satu endpoint.

Mari kita bedah bagaimana OmniRouter bekerja dan bagaimana cara memanfaatkan semuanya.

Apa Itu OmniRouter?

OmniRouter adalah AI gateway open-source yang:

  • Menghubungkan 237 AI providers dalam satu endpoint
  • Menyediakan 90+ free tiers tanpa biaya
  • Mendukung auto-fallback antar provider
  • Menggunakan RTK + Caveman compression untuk hemat 15–95% tokens
  • Kompatibel dengan Claude Code, Codex, Cursor, Cline, Copilot
  • Endpoints yang Didukung

    CODE
    /v1/chat/completions    → Chat completions (OpenAI format)
    /v1/completions         → Legacy completions
    /v1/models              → Model listing
    /api/mcp                → MCP server protocol

    Setup OmniRouter

    BASH
    # Pull image
    docker pull diegosouzapw/omniroute:latest
    
    # Run dengan data persistence
    docker run -d \\
      --name omniroute \\
      -p 20129:20128 \\
      -v /path/to/data:/app/data \\
      diegosouzapw/omniroute:latest

    Metode 2: NPM

    BASH
    # Install
    npm i -g omniroute
    
    # Initialize
    omniroute init
    
    # Start
    omniroute serve

    Environment Variables Penting

    VariableFungsiDefault
    JWT_SECRETSession token signingWajib set
    API_KEY_SECRETAPI key encryptionWajib set
    PORTPort server20128
    INITIAL_PASSWORDPassword admin awalCHANGEME
    STORAGE_ENCRYPTION_KEYDB encryptionOpsional

    Dashboard & Management

    OmniRoute memiliki dashboard web yang bisa diakses di http://localhost:20129/dashboard:

  • Settings → AI Providers: Tambah/hapus provider
  • Settings → Models: Kelola model yang tersedia
  • Settings → Security: Configure auth & encryption
  • Settings → Routing: Atur routing strategies
  • Menambahkan Provider

  • Buka Dashboard → SettingsAI Providers
  • Pilih provider (OpenAI, Anthropic, Gemini, dll)
  • Masukkan API key
  • Simpan dan test koneksi
  • Menambahkan Model

    Setelah provider terdaftar, modelnya otomatis muncul di /v1/models. Kamu juga bisa:

  • Filter berdasarkan kategori (coding, reasoning, vision, dll)
  • Set default model untuk routing otomatis
  • Configure fallback strategies
  • 18 Model Free dengan Tool Calling

    Berikut model-model gratis yang bisa langsung dipakai dari OmniRoute:

    🔥 Top Picks untuk Coding

    ModelProviderContextCapabilities
    qwen/qwen3-coder:freeOpenRouter1M ✅🔧 tc ✅
    openrouter/openai/gpt-oss-120b:freeOpenAI128K🔧 tc ✅
    openrouter/qwen/qwen3-next-80b-a3b:freeOpenRouter262K🔧 tc ✅
    openrouter/meta-llama/llama-3.3-70b-instruct:freeMeta128K🔧 tc ✅
    openrouter/nousresearch/hermes-3-llama-3.1-405b:freeNous128K🔧 tc ✅

    🧠 Vision + Reasoning

    ModelContextVision
    openrouter/google/gemma-4-31b-it:free262K👁️
    openrouter/google/gemma-4-26b-a4b-it:free262K👁️
    openrouter/nvidia/nemotron-3-nano-omni-30b-a3b-reasoning:free256K👁️

    ⚡ Lainnya

    ModelContextCatatan
    openrouter/nvidia/nemotron-3-super-120b-a12b:free1MNo vision
    openrouter/nvidia/nemotron-3-ultra-550b-a55b:free1MNo vision
    openrouter/openai/gpt-oss-20b:free128KLightweight
    openrouter/poolside/laguna-xs.2:free262KFast
    openrouter/liquid/lfm-2.5-1.2b-thinking:free32KThinking

    Routing Strategies — Fitur Unggulan

    OmniRoute punya 17 routing strategies yang otomatis memilih model terbaik:

    Auto Router (Auto-Select)

    BASH
    # OmniRoute otomatis pilih model terbaik
    curl http://localhost:20129/v1/chat/completions \\
      -H "Content-Type: application/json" \\
      -d '{
        "model": "auto/best-coding",
        "messages": [{"role":"user","content":"Fix this bug..."}]
      }'
    Model IDKegunaan
    auto/best-codingCoding terbaik
    auto/best-reasoningReasoning terbaik
    auto/best-fastRespons tercepat
    auto/best-visionVision/gambar
    auto/best-chatChat umum
    auto/best-freeGratis
    auto/claude-opusClaude Opus
    auto/claude-sonnetClaude Sonnet

    Pro & Advanced

    CODE
    auto/coding:pro       → Coding premium
    auto/reasoning:pro    → Reasoning premium  
    auto/coding:fast      → Coding cepat
    auto/coding:cheap     → Coding murah
    auto/coding:reliable  → Coding andal

    Token Optimization

    OmniRoute menghemat token dengan RTK (Response Token Kinetics) + Caveman Compression:

    Sebelum Compression

    CODE
    User: "Jelaskan cara kerja function calling di Claude"
    AI: [4000 tokens response]

    Setelah Compression

    CODE
    User: "Jelaskan cara kerja function calling di Claude"
    AI: [300-600 tokens response — 85% hemat!]

    Cara Kerja Caveman Compression

  • Identify core facts — ekstrak informasi inti dari response
  • Remove filler — buang kata-kata pembuangan yang tidak perlu
  • Preserve code — kode tetap utuh dan bisa di-copy
  • Maintain structure — markdown formatting tetap terjaga
  • Hasilnya: 15–95% token savings tergantung konten.

    API Usage Example

    Chat Completion

    BASH
    curl http://localhost:20129/v1/chat/completions \\
      -H "Content-Type: application/json" \\
      -H "Authorization: Bearer YOUR_API_KEY" \\
      -d '{
        "model": "qwen/qwen3-coder:free",
        "messages": [
          {"role": "system", "content": "You are a helpful coding assistant."},
          {"role": "user", "content": "Write a Python function to sort a list"}
        ],
        "max_tokens": 500
      }'

    List Models

    BASH
    curl http://localhost:20129/v1/models | python3 -m json.tool | head -50

    Streaming Response

    BASH
    curl http://localhost:20129/v1/chat/completions \\
      -H "Content-Type: application/json" \\
      -d '{
        "model": "auto/best-coding",
        "messages": [{"role":"user","content":"Hello!"}],
        "stream": true
      }'

    Kesimpulan

    OmniRoute adalah solusi terbaik untuk mengakses 237 AI providers dengan biaya $0. Dengan:

  • 90+ free providers
  • 17 routing strategies
  • 15-95% token savings
  • Auto-fallback antar provider
  • Dashboard management yang user-friendly
  • Cukup setup sekali, dan kamu punya akses ke semua AI model favorit tanpa khawatir biaya API.

    Start your journey today — deploy via Docker dan mulai eksplorasi 237 providers! 🚀