InferX

اینفرکس

InferX
★★★★★★★★★★۴
ویدئوی آموزش ابزار (به زودی)مشاهده سایت
Free tier برای تست · Developer حدود ۱ دلار/ماه (+ اعتبار) · Pay-as-you-go با اعتبار · GPU سرورلس از حدود ۳٫۹۵ دلار/ساعت H100

زیرساخت استنتاج سرورلس برای مدل‌های AI با cold start بسیار سریع، API سازگار با OpenAI و پرداخت فقط برای زمان فعال GPU.

معرفی: اینفرکس

اینفرکس (inferx.net) پلتفرم Inference زیرساختی است: به‌جای نگه‌داشتن دائم GPU گرم، وضعیت اجراشدهٔ مدل (snapshot) را بازیابی می‌کند تا cold start در حد زیرثانیه تا چند ثانیه برای مدل‌های بزرگ ممکن شود و بین درخواست‌ها scale-to-zero شود. کلاینت OpenAI موجود را با عوض کردن base_url به endpoint اینفرکس وصل می‌کنید.

مسیرها: API میزبانی‌شدهٔ مدل‌های آماده، دیپلوی سرورلس مدل خودتان، و لایسنس پلتفرم روی Kubernetes/ابر خصوصی. قیمت‌گذاری ترکیبی از پلن Developer (ارزان + اعتبار ماهانه)، Pay-as-you-go با اعتبار پیش‌پرداخت، تعرفه‌های توکنی مدل‌های میزبانی‌شده، و GPU-hour برای endpoint اختصاصی. مخاطب اصلی تیم محصول/ML است نه کاربر نهایی چت.

تصاویر محیط ابزار

نقاط قوت

  • cold start سریع با GPU snapshot restore
  • سازگاری OpenAI SDK — تغییر یک خط base_url
  • اقتصاد scale-to-zero در برابر GPU همیشه روشن
  • مسیر hosted + custom + on-prem/platform

نقاط ضعف

  • برای کاربر غیرفنی سنگین است — پنل چت ساده نیست
  • قیمت دقیق توکن/GPU بسته به مدل و منطقه فرق می‌کند
  • وابستگی به زیرساخت خارجی برای تیم‌های داخل ایران (تحریم/پرداخت)

قیمت‌گذاری

Free Tier

Free

رایگان

  • مدل‌های رایگان تست
  • API سازگار OpenAI
  • بدون کارت برای شروع

Developer

Developer

$1 در ماه

  • حدود ۱ دلار/ماه + اعتبار استفاده (مثلاً ۵ دلار طبق پیشنهاد روز سایت)
  • قیمت تخفیف‌خوردهٔ مدل‌ها
  • Zero data retention اعلام‌شده

Pay as you go

Pay as you go

تماس / سفارشی

  • اعتبار پیش‌پرداخت
  • بدون تعهد ماهانه
  • مناسب دمو و بار گاه‌به‌گاه

Serverless GPU / Enterprise

Serverless / Enterprise

تماس / سفارشی

  • H100/H200 حدود ۳٫۹۵ دلار/ساعت GPU فعال
  • دیپلوی مدل سفارشی و ظرفیت اختصاصی
  • پلتفرم on-prem / sovereign

قیمت‌ها تقریبی و بر اساس آخرین بازبینی است؛ برای قیمت دقیق به سایت رسمی مراجعه کنید.

پرسش‌های پرتکرار

چطور به کد OpenAI وصلش کنم؟

همان SDK؛ فقط base_url را روی endpoint اینفرکس (مثلاً https://model.inferx.net/v1) و api_key خودتان بگذارید.

با OpenRouter چه فرقی دارد؟

OpenRouter بیشتر marketplace مدل است؛ InferX روی runtime سرورلس، snapshot و بهره‌وری GPU تمرکز دارد.

امتیاز و نظر شما

بدون نیاز به ثبت‌نام؛ نظر متنی پس از بررسی منتشر می‌شود.

نظرات کاربران

هنوز نظری ثبت نشده — اولین نفر باشید!

ابزارهای مشابه

مشاهده همه