OmniRoute / سطح API

یک نقطه پایانی، فراتر از چت.

چت، امبدینگ، رتبه‌بندی مجدد، تصویر، ویدیو، موسیقی، گفتار، OCR، فایل‌ها و بچ‌ها، در همان فرمت درخواستی که کلاینت شما می‌شناسد.

فرمت‌های سیمی

ساختار درخواستی که کلاینت شما می‌فرستد را نگه دارید.

یک فرایند چند فرمت را می‌پذیرد، پس ابزاری که با SDK یک فروشنده ساخته شده فقط به تغییر base URL نیاز دارد و هیچ چیز دیگر.

OpenAI

Chat Completions، امبدینگ، تصویر، صدا و فایل‌ها، بدون تغییر.

/v1/chat/completions

Anthropic

فرمت سیمی Messages، شامل شمارش توکن.

/v1/messages

OpenAI Responses

ساختار Responses API، با فشرده‌سازی خروجی ابزار.

/v1/responses

Gemini

generateContent و فهرست مدل‌های Gemini.

/v1beta/models

Ollama

جایگزین مستقیم برای ابزارهایی که با API محلی Ollama کار می‌کنند.

/v1/api/chat

Rerank and Jina

رتبه‌بندی مجدد Cohere/Voyage به‌همراه classify و segment از Jina.

/v1/rerank

نقاط پایانی

فراتر از chat completions.

دسته‌بندی بر اساس کاری که می‌خواهید انجام دهید، نه ارائه‌دهنده‌ای که آن را سرویس می‌دهد.

چت و پیام‌ها

سه ساختار درخواست به یک مسیریاب می‌رسند، پس کلاینت فرمتی را که می‌شناسد نگه می‌دارد.

  • POST/v1/chat/completionsOpenAI Chat Completions، استریم یا بافرشده
  • POST/v1/messagesAnthropic Messages
  • POST/v1/responsesOpenAI Responses
  • POST/v1/messages/count_tokensشمارش توکن‌ها پیش از خرج کردن

امبدینگ، جستجو و رتبه‌بندی

نیمه بازیابی یک پشته RAG پشت همان نقطه پایانی و همان کلید.

  • POST/v1/embeddingsامبدینگ متنی و چندوجهی
  • POST/v1/rerankرتبه‌بندی مجدد سازگار با Cohere و Voyage
  • POST/v1/searchانتزاع جستجوی وب بین ارائه‌دهندگان
  • POST/v1/classifyدسته‌بندی متن Jina
  • POST/v1/segmentقطعه‌بندی محتوای Jina
  • POST/v1/web/fetchاستخراج خوانای صفحه

تصویر، ویدیو و موسیقی

تولید از همان مسیر جایگزینی و حسابداری هزینه متن می‌گذرد.

  • POST/v1/images/generationsتولید تصویر
  • POST/v1/images/editsویرایش و inpainting
  • POST/v1/videos/generationsتولید ویدیو
  • POST/v1/music/generationsتولید موسیقی

صدا و اسناد

گفتار در هر دو جهت، به‌همراه OCR برای منابع اسکن‌شده.

  • POST/v1/audio/transcriptionsگفتار به متن
  • POST/v1/audio/translationsترجمه رونویسی
  • POST/v1/audio/speechمتن به گفتار
  • POST/v1/ocrOCR اسناد

فایل‌ها و بچ‌ها

یک بار آپلود کنید و کار را به‌صورت ناهمگام اجرا کنید، به جای نگه داشتن اتصال باز.

  • POST/v1/filesآپلود فایل
  • GET/v1/files/{id}/contentاستریم محتوای فایل
  • POST/v1/batchesایجاد کار بچ
  • GET/v1/batches/{id}بررسی وضعیت بچ
  • POST/v1/batches/{id}/cancelلغو بچ در حال اجرا

کشف و کنترل

هر آنچه کلاینت برای انتخاب مدل و ماندن در بودجه نیاز دارد.

  • GET/v1/modelsکاتالوگ مدل‌ها به تفکیک ارائه‌دهنده
  • GET/v1/quotas/checkاعتبارسنجی پیشین سهمیه باقی‌مانده
  • POST/v1/moderationsنظارت بر محتوا
  • GET/v1/wsارتقا به WebSocket برای کلاینت‌های استریم

پروتکل‌های ایجنت

یک سرور MCP با 110 ابزار و یک agent card از A2A، از همان فرایند.

  • GET/api/mcp/streamMCP روی HTTP، 33 محدوده
  • GET/api/mcp/sseMCP روی Server-Sent Events
  • POST/a2aJSON-RPC 2.0، 6 مهارت ایجنت
  • GET/.well-known/agent.jsonagent card عمومی

هدرها

هر پاسخ می‌گوید چطور سرویس شده.

مسیریابی جعبه سیاه نیست: تصمیم، هزینه و فشرده‌سازی‌ای که پاسخ را ساخته‌اند همراه آن برمی‌گردند.

هدرهای پاسخ

  • X-OmniRoute-Decisionاستراتژی، نام مستعار ارائه‌دهنده و تأخیری که درخواست را سرویس داد
  • X-OmniRoute-Providerنام مستعار ارائه‌دهنده‌ای که واقعاً به آن مسیریابی شد
  • X-OmniRoute-Modelشناسه مدل نهایی
  • X-OmniRoute-Latency-Msتأخیر آپ‌استریم به میلی‌ثانیه
  • X-OmniRoute-Tokens-Inشمار توکن ورودی
  • X-OmniRoute-Tokens-Outشمار توکن خروجی
  • X-OmniRoute-Response-Costهزینه دلاری این پاسخ
  • X-OmniRoute-Cost-Savedدلار صرفه‌جویی‌شده در برخورد با کش
  • X-OmniRoute-CacheHIT یا MISS در درخواست‌های غیراستریم
  • X-OmniRoute-Compressionحالت فشرده‌سازی اعمال‌شده و منبع آن
  • X-OmniRoute-Fallback-Attemptsپرش‌های جایگزینی انجام‌شده، اگر وجود داشت
  • X-OmniRoute-Request-Idشناسه همبستگی برای لاگ درخواست

هدرهای درخواست

  • x-omniroute-compressionبازنویسی پروفایل فشرده‌سازی برای یک درخواست
  • X-OmniRoute-No-Cacheدور زدن کش معنایی
  • x-omniroute-no-memoryرد کردن تزریق حافظه و مهارت‌ها
  • X-Session-Idکلید وابستگی نشست و انتساب هزینه
  • Idempotency-Keyحذف تکرار درخواست دوباره ارسال‌شده
مرجع API را بخوانید (در تب جدید باز می‌شود)

OmniRoute از Cheaper Inference

انتخاب کنید OmniRoute را چطور اجرا کنید.

OmniRoute را خودتان میزبانی کنید، یا از Cheaper Inference برای یک گیت‌وی میزبانی‌شده با رتبه‌بندی هزینه استفاده کنید.