رفتن به محتوای اصلی

مستندات API هوش مصنوعی

یک آدرس، یک کلید، همه مدل‌ها؛ با فرمت OpenAI، Anthropic یا Gemini.

OpenAI · Anthropic · Geminiاستریم SSE

API هوش مصنوعی گره یک درگاه واحد برای مدل‌های Claude، GPT، Gemini، DeepSeek و دیگران است. همان API رسمی هر سازنده را روی آدرس گره صدا می‌زنید؛ گره درخواست را به مدل می‌رساند، پاسخ را در همان فرمتی که فرستاده‌اید برمی‌گرداند و هزینه را به تومان از کیف پول کم می‌کند.

شروع سریع

  1. در گره ثبت‌نام کنید و کیف پول را شارژ کنید.
  2. در پنل › API هوش مصنوعی یک کلید بسازید. کلید با gk- شروع می‌شود و فقط یک بار نمایش داده می‌شود.
  3. در برنامه یا ابزارتان آدرس پایه را به https://api.gereh.dev تغییر دهید و کلید را به‌جای کلید OpenAI، Anthropic یا Gemini بگذارید.

نشانی پایه

https://api.gereh.dev

برای SDKهای OpenAI آدرس https://api.gereh.dev/v1 و برای Anthropic و Gemini خود https://api.gereh.dev را بدهید.

احراز هویت

کلید را به یکی از این روش‌ها بفرستید (هر SDK روش خودش را خودکار به‌کار می‌برد):

روشنمونه
هدر AuthorizationAuthorization: Bearer gk-…
هدر Anthropicx-api-key: gk-…
هدر Geminix-goog-api-key: gk-…
پارامتر Gemini?key=gk-…

مسیرها

متدمسیرتوضیح
POST/v1/chat/completionsOpenAI Chat Completions (استریم، ابزار، تصویر، JSON mode)
POST/v1/responsesOpenAI Responses — برای Codex؛ بدون حالت ذخیره‌شده (store)
POST/v1/messagesAnthropic Messages — برای Claude Code و SDK رسمی Anthropic
POST/v1/messages/count_tokensشمارش تقریبی توکن ورودی (Anthropic)
POST/v1beta/models/{model}:generateContentGoogle Gemini (و ‎:streamGenerateContent?alt=sse)
GET/v1/modelsفهرست مدل‌ها (با هدر anthropic-version به شکل Anthropic)
GET/v1beta/modelsفهرست مدل‌ها به شکل Gemini

Claude Code

Claude Code مستقیم با فرمت Anthropic به گره وصل می‌شود؛ ابزارها، استریم و فایل‌خوانی همه کار می‌کنند.

export ANTHROPIC_BASE_URL=https://api.gereh.dev
export ANTHROPIC_AUTH_TOKEN=gk-YOUR-KEY
export ANTHROPIC_MODEL=claude-opus-5.5
export ANTHROPIC_DEFAULT_HAIKU_MODEL=claude-haiku-4.5
claude

Codex CLI

در ‎~/.codex/config.toml بگذارید و کلید را در متغیر GEREH_API_KEY قرار دهید (export GEREH_API_KEY=…).

model = "gpt-5.5"
model_provider = "gereh"

[model_providers.gereh]
name = "Gereh"
base_url = "https://api.gereh.dev/v1"
env_key = "GEREH_API_KEY"
wire_api = "responses"

OpenAI SDK و ابزارهای سازگار

هر برنامه یا کتابخانه سازگار با OpenAI (LangChain، n8n، Cursor، Continue، LibreChat…) فقط با تغییر base URL کار می‌کند.

from openai import OpenAI

client = OpenAI(base_url="https://api.gereh.dev/v1", api_key="gk-YOUR-KEY")
r = client.chat.completions.create(
    model="gpt-5.5",
    messages=[{"role": "user", "content": "سلام!"}],
)
print(r.choices[0].message.content)

در Cursor: Settings › Models › OpenAI API Key، کلید گره را وارد و «Override OpenAI Base URL» را روی https://api.gereh.dev/v1 بگذارید. در n8n، اعتبارنامه OpenAI را با Base URL همین آدرس بسازید.

Anthropic SDK

SDK رسمی Anthropic؛ ابزارها (tool use)، تصویر و استریم پشتیبانی می‌شوند.

import anthropic

client = anthropic.Anthropic(base_url="https://api.gereh.dev", api_key="gk-YOUR-KEY")
msg = client.messages.create(
    model="claude-sonnet-5.5", max_tokens=1024,
    messages=[{"role": "user", "content": "سلام!"}],
)
print(msg.content[0].text)

Gemini SDK

SDK گوگل (google-genai) با آدرس گره؛ مدل‌های دیگر هم با همین فرمت قابل فراخوانی‌اند.

from google import genai

client = genai.Client(api_key="gk-YOUR-KEY", http_options={"base_url": "https://api.gereh.dev"})
r = client.models.generate_content(model="gemini-3.8-flash", contents="سلام!")
print(r.text)

cURL

ساده‌ترین تست از ترمینال.

curl https://api.gereh.dev/v1/chat/completions \
  -H "Authorization: Bearer gk-YOUR-KEY" \
  -H "Content-Type: application/json" \
  -d '{"model":"gpt-4o-mini","messages":[{"role":"user","content":"سلام!"}]}'

استریم

در همه فرمت‌ها استریم پشتیبانی می‌شود: "stream": true در OpenAI و Anthropic و مسیر :streamGenerateContent?alt=sse در Gemini. رویدادها دقیقاً با قالب رسمی هر سازنده ارسال می‌شوند، پس SDKها و ابزارها بدون تغییر کار می‌کنند. در OpenAI Chat برای دریافت مصرف توکن در انتهای استریم "stream_options": {"include_usage": true} بفرستید.

هزینه و صورتحساب

  • هزینه هر درخواست = (توکن ورودی × قیمت ورودی + توکن خروجی × قیمت خروجی) ÷ ۱٬۰۰۰٬۰۰۰، به تومان و رو به بالا.
  • پیش از ارسال، حداکثر هزینه ممکن (بر اساس max_tokens) از کیف پول رزرو و بلافاصله پس از پاسخ، مازاد آن برگردانده می‌شود. اگر max_tokens نفرستید ۸٬۱۹۲ در نظر گرفته می‌شود.
  • درخواست ناموفق (خطای سرویس‌دهنده) هیچ هزینه‌ای ندارد.
  • هر پاسخ موفق هدر x-gereh-charged-toman (هزینه به تومان) و x-gereh-request-id (شناسه پیگیری) دارد.
  • مصرف هر ۱۰ دقیقه در یک تراکنش «مصرف» در صورتحساب جمع می‌شود.

محدودیت‌ها

  • برای هر کلید می‌توانید سقف هزینه روزانه و ماهانه، فهرست مدل‌های مجاز، تعداد درخواست در دقیقه (پیش‌فرض ۱۲۰، حداکثر ۶۰۰) و تاریخ انقضا تعیین کنید.
  • حداکثر حجم هر درخواست ۱۶ مگابایت است.
  • در Responses API حالت ذخیره سمت سرور (previous_response_id، background، conversation) پشتیبانی نمی‌شود؛ تاریخچه را در input بفرستید. Codex به‌طور پیش‌فرض همین کار را می‌کند.
  • متن درخواست‌ها و پاسخ‌ها ذخیره نمی‌شود؛ فقط مدل، توکن، هزینه و زمان پاسخ در گزارش می‌ماند.

کدهای خطا

HTTPکدمعنی
400invalid_requestبدنه یا پارامترها نادرست است
401invalid_api_key / key_expiredکلید نامعتبر یا منقضی
402insufficient_balanceموجودی کیف پول کافی نیست
402key_budget_exceededسقف روزانه یا ماهانه کلید پر شده
403key_disabled / model_not_allowedکلید باطل شده یا مدل برای این کلید مجاز نیست
404model_not_foundمدل وجود ندارد یا غیرفعال است
429rate_limit_exceededسقف درخواست در دقیقه کلید
429upstream_rate_limitedظرفیت لحظه‌ای مدل پر است؛ دوباره تلاش کنید
502upstream_error / upstream_unavailableخطای سرویس‌دهنده مدل؛ هزینه‌ای کم نمی‌شود

قالب بدنه خطا با فرمت درخواست یکی است (OpenAI، Anthropic یا Gemini) تا SDKها خطا را درست نمایش دهند.

مدل‌ها و قیمت

قیمت‌ها به تومان و به ازای یک میلیون توکن است.

مدلشناسهورودیخروجیکانتکست
Claude Opus 5.5claude-opus-5.5۱٬۸۲۴٬۰۰۰۹٬۱۲۰٬۰۰۰۱٬۰۰۰K
Claude Sonnet 5.5claude-sonnet-5.5۹۱۲٬۰۰۰۴٬۵۶۰٬۰۰۰۱٬۰۰۰K
Claude Sonnet 5claude-sonnet-5۹۱۲٬۰۰۰۴٬۵۶۰٬۰۰۰۱٬۰۰۰K
Claude Opus 5claude-opus-5۲٬۲۸۰٬۰۰۰۱۱٬۴۰۰٬۰۰۰۱٬۰۰۰K
Claude Sonnet 4.6claude-sonnet-4.6۱٬۳۶۸٬۰۰۰۶٬۸۴۰٬۰۰۰۱٬۰۰۰K
Claude Haiku 4.5claude-haiku-4.5۴۵۶٬۰۰۰۲٬۲۸۰٬۰۰۰۲۰۰K
GPT-6 Solgpt-6-sol۹۱۲٬۰۰۰۴٬۵۶۰٬۰۰۰۱٬۰۵۰K
GPT-6 Lunagpt-6-luna۴۵٬۶۰۰۲۲۸٬۰۰۰۱٬۰۵۰K
GPT-5.5gpt-5.5۲٬۲۸۰٬۰۰۰۱۳٬۶۸۰٬۰۰۰۱٬۰۵۰K
GPT-5.4gpt-5.4۱٬۱۴۰٬۰۰۰۶٬۸۴۰٬۰۰۰۱٬۰۵۰K
GPT-5.4 Minigpt-5.4-mini۳۴۲٬۰۰۰۲٬۰۵۲٬۰۰۰۴۰۰K
GPT-5.4 Nanogpt-5.4-nano۹۱٬۲۰۰۵۷۰٬۰۰۰۴۰۰K
GPT-4.1gpt-4.1۹۱۲٬۰۰۰۳٬۶۴۸٬۰۰۰۱٬۰۴۸K
GPT-4.1 Minigpt-4.1-mini۱۸۲٬۴۰۰۷۲۹٬۶۰۰۱٬۰۴۸K
GPT-4ogpt-4o۱٬۱۴۰٬۰۰۰۴٬۵۶۰٬۰۰۰۱۲۸K
GPT-4o minigpt-4o-mini۶۸٬۴۰۰۲۷۳٬۶۰۰۱۲۸K
o3o3۹۱۲٬۰۰۰۳٬۶۴۸٬۰۰۰۲۰۰K
gpt-oss-120bgpt-oss-120b۶۸٬۴۰۰۲۷۳٬۶۰۰۱۳۱K
Gemini 3.8 Flashgemini-3.8-flash۳۴۲٬۰۰۰۱٬۷۱۰٬۰۰۰۱٬۰۴۹K
Gemini 3.1 Progemini-3.1-pro۹۱۲٬۰۰۰۵٬۴۷۲٬۰۰۰۱٬۰۴۹K
Gemini 2.5 Progemini-2.5-pro۵۷۰٬۰۰۰۴٬۵۶۰٬۰۰۰۱٬۰۴۹K
Gemini 2.5 Flashgemini-2.5-flash۱۳۶٬۸۰۰۱٬۱۴۰٬۰۰۰۱٬۰۴۹K
DeepSeek V4 Prodeepseek-v4-pro۱۸۲٬۴۰۰۱٬۹۱۵٬۲۰۰۱٬۰۴۹K
DeepSeek V4 Flashdeepseek-v4-flash۱۳۶٬۸۰۰۵۴۷٬۲۰۰۱٬۰۴۹K
DeepSeek V3.2deepseek-v3.2۱۲۷٬۷۰۰۱۹۱٬۵۰۰۱۶۴K
DeepSeek R1deepseek-r1۲۲۸٬۰۰۰۹۸۰٬۴۰۰۱۶۴K
Qwen 3.8 Maxqwen3.8-max۹۱۲٬۰۰۰۲٬۷۳۶٬۰۰۰۱٬۰۰۰K
Qwen3 Coder 480Bqwen3-coder۱۳۶٬۸۰۰۴۵۶٬۰۰۰۲۶۲K
GLM 5.3 Flashglm-5.3-flash۶۸٬۴۰۰۲۲۸٬۰۰۰۱٬۳۱۱K