OpenAI
Chat Completions, embeddings, imagini, audio și fișiere, neschimbate.
/v1/chat/completionsOmniRoute / Suprafața API
Chat, embeddings, reranking, imagini, video, muzică, vorbire, OCR, fișiere și batch-uri, în formatul de cerere pe care clientul tău îl vorbește deja.
Formate de transport
Un singur proces acceptă mai multe formate, așa că un tool construit pe SDK-ul unui vendor are nevoie doar de o schimbare a URL-ului de bază.
Chat Completions, embeddings, imagini, audio și fișiere, neschimbate.
/v1/chat/completionsFormatul Messages, inclusiv numărarea tokenilor.
/v1/messagesForma Responses API, cu compactarea output-ului tool-urilor.
/v1/responsesgenerateContent și lista de modele Gemini.
/v1beta/modelsÎnlocuitor direct pentru tool-urile care vorbesc API-ul local Ollama.
/v1/api/chatReranking Cohere/Voyage plus Jina classify și segment.
/v1/rerankEndpoint-uri
Grupate după ce vrei să faci, nu după furnizorul care se întâmplă să servească.
Trei forme de cerere ajung la același router, așa că un client păstrează formatul pe care îl vorbește deja.
/v1/chat/completionsOpenAI Chat Completions, streaming sau buffered/v1/messagesAnthropic Messages/v1/responsesOpenAI Responses/v1/messages/count_tokensNumără tokenii înainte să-i cheltuieștiJumătatea de retrieval a unui stack RAG, în spatele aceluiași endpoint și al aceleiași chei.
/v1/embeddingsEmbeddings text și multimodale/v1/rerankReranking compatibil Cohere și Voyage/v1/searchAbstracție de căutare web peste furnizori/v1/classifyClasificare de text Jina/v1/segmentSegmentare de conținut Jina/v1/web/fetchExtragere de pagini în format lizibilGenerarea trece prin același fallback și aceeași contabilizare a costurilor ca textul.
/v1/images/generationsSinteză de imagini/v1/images/editsEditare și inpainting/v1/videos/generationsGenerare video/v1/music/generationsSinteză muzicalăVorbire în ambele direcții, plus OCR pentru materiale sursă scanate.
/v1/audio/transcriptionsVorbire în text/v1/audio/translationsTranscriere cu traducere/v1/audio/speechText în vorbire/v1/ocrOCR pentru documenteÎncarcă o dată, apoi rulează lucrul asincron în loc să ții o conexiune deschisă.
/v1/filesÎncarcă un fișier/v1/files/{id}/contentRedă conținutul fișierului în stream/v1/batchesCreează un job batch/v1/batches/{id}Interoghează starea batch-ului/v1/batches/{id}/cancelAnulează un batch în cursTot ce are nevoie un client pentru a alege un model și a rămâne în buget.
/v1/modelsCatalog de modele grupat pe furnizori/v1/quotas/checkVerifică în avans cota rămasă/v1/moderationsModerare de conținut/v1/wsUpgrade WebSocket pentru clienți de streamingUn server MCP cu 110 tool-uri și un agent card A2A, servite de același proces.
/api/mcp/streamMCP prin HTTP, 33 scope-uri/api/mcp/sseMCP prin Server-Sent Events/a2aJSON-RPC 2.0, 6 skill-uri de agent/.well-known/agent.jsonAgent card publicHeader-e
Rutarea nu e o cutie neagră: decizia, costul și compresia care au produs un răspuns se întorc împreună cu el.
X-OmniRoute-DecisionStrategia, aliasul furnizorului și latența care au servit cerereaX-OmniRoute-ProviderAliasul furnizorului către care s-a rutat efectivX-OmniRoute-ModelIdentificatorul de model rezolvatX-OmniRoute-Latency-MsLatența upstream în milisecundeX-OmniRoute-Tokens-InNumăr de tokeni de intrareX-OmniRoute-Tokens-OutNumăr de tokeni de ieșireX-OmniRoute-Response-CostCostul în USD al acestui răspunsX-OmniRoute-Cost-SavedUSD evitați la un cache hitX-OmniRoute-CacheHIT sau MISS la cererile fără streamingX-OmniRoute-CompressionModul de compresie aplicat și de unde a venitX-OmniRoute-Fallback-AttemptsSalturile de fallback făcute, dacă au existatX-OmniRoute-Request-IdId de corelare pentru jurnalul de cererix-omniroute-compressionSuprascrie profilul de compresie pentru o cerereX-OmniRoute-No-CacheOcolește cache-ul semanticx-omniroute-no-memorySari peste injectarea memoriei și a skill-urilorX-Session-IdCheie de afinitate a sesiunii și atribuire a costurilorIdempotency-KeyDeduplică o cerere reîncercată