تخطَّ إلى المحتوى
الحدود والرصيد

الحدود والرصيد

كل طلب يُخدَّم بالتساوي. لا شرائح لمعدل الطلبات. ولا حصة API منفصلة. لقد دفعت ثمن tokens مسبقاً، فاستخدمها بالسرعة التي تشاء.

تشرح هذه الصفحة مما يتكوّن رصيدك، وما الذي يحجزه الطلب الواحد وكم يكلّف، وكم طلباً يمكنك إرساله، والحدود القليلة التي قد يواجهها الطلب الواحد.

قيمة 1M token من الرصيد
$5.00
تجدد المخصص اليومي
00:00 UTC
الحماية من الإغراق، لكل حساب
120 طلب / دقيقة

كيف تُخدَّم الطلبات

  • لا شرائح لمعدل الطلبات — قاعدة واحدة تحدد سرعة وصول الطلبات، وهي نفسها لكل حساب ولكل خطة: 120 طلباً في الدقيقة. ولا حد على الـ tokens في الدقيقة.
  • لا حصة API منفصلة — تُنفق API الرصيد نفسه الذي تنفقه الدردشة. وتحدد الخطة حجم مخصصات اليوم، ولا تحدد معدل الطلبات.
  • بالسرعة التي تشاء — الطلبات المرسلة بالتوازي تُقبل وتنتظر في الطابور. ولا تُرفض لمجرد أنها متوازية.

رصيدك

يُحسب رصيدك بالـ tokens. وقيمة 1,000,000 token من الرصيد تساوي $5.00، وكل سعر في صفحة Models & pricing هو معدل مقابل هذه القيمة.

في أي لحظة يكون الرصيد مجموع جزأين.

  • مخصصات الخطة لليوم — عدد من الـ tokens تحدده خطتك. يتجدد كل يوم عند 00:00 UTC. وما يتبقى في نهاية اليوم لا يُرحَّل.
  • الرصيد المشتري — الـ tokens التي اشتريتها كحزمة. لا تنتهي صلاحية الرصيد، ويعمل مع كل خطة، بما فيها Free.
الخطة tokens في اليوم القيمة
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • ترتيب الإنفاق — يُنفق كل طلب مخصصات الخطة لليوم أولاً. ولا يُستخدم الرصيد المشتري إلا لما يتجاوز المخصصات في ذلك اليوم.
  • الدردشة وAPI يتشاركانه — يوجد رصيد واحد لكل حساب. ويُنفق مفتاح API من رصيد الحساب الذي يملكه، بالأسعار نفسها المعتمدة في الدردشة.
  • الحزم — يُباع الرصيد في حزم من 1,000,000 ($5.00) و2,000,000 ($10.00) و5,000,000 ($25.00) token، أو بمبلغ تختاره من 1,000,000 إلى 100,000,000 token بسعر $5.00 لكل 1,000,000.

شحن الرصيد تغيير الخطة

ما يحجزه الطلب وما يكلّفه

  • الحجز — عند وصول الطلب يحجز ميزانية مخرجاته من رصيدك: max_tokens على /v1/chat/completions و/v1/messages، وmax_output_tokens على /v1/responses. كما يقرأ /v1/chat/completions الحقل max_completion_tokens. القيمة الافتراضية 4,096 والمدى من 1 إلى 65,536.
  • القبول — يُقبل الطلب فقط إذا كان الحجز ضمن ما تبقى من رصيدك. والرصيد الذي يزيد على الصفر لكنه أقل من ميزانية المخرجات يحصل على الرد Quota exceeded. أرسل max_tokens أصغر لاستخدام المتبقي.
  • التسوية — عند اكتمال الإجابة يُستبدل الحجز بالتكلفة الفعلية. وقد تكون التكلفة أقل من الحجز أو أعلى منه.
  • الإرجاع — الطلب الذي ينتهي بحالة خطأ يُعاد حجزه كاملاً.

تعتمد التكلفة الفعلية على عائلة النموذج.

النماذج ما يُحتسب
نماذج Shannon usage.total_tokens بسعر النموذج لكل 1M. وللمدخلات والمخرجات سعر واحد.
النماذج المفتوحة الأوزان المستضافة المدخلات غير المخبأة بسعر المدخلات، والمدخلات المخبأة بسعر المخبأ، والمخرجات بسعر المخرجات.

يُخصم المبلغ بالدولار من رصيدك بالـ tokens بسعر $5.00 لكل 1,000,000، مقرباً إلى token كامل.

عدّ الـ tokens عبر POST /v1/tokenize أو POST /v1/messages/count_tokens مجاني ولا يحجز شيئاً. عدّ الـ tokens

أين ترى الرصيد والاستخدام

تعرض صفحة Keys & usage ما يمكنك إنفاقه الآن، ومخصصات الخطة لليوم، ورصيدك المشتري، وإنفاق API خلال آخر 30 يوماً. وتحتها قائمة بكل طلب أرسله مفتاحك: الوقت ونقطة النهاية والنموذج والمدخلات المخبأة والـ tokens المحتسبة والتكلفة. المفاتيح والاستخدام

يحمل كل رد أيضاً كائن usage فيه عدد الـ tokens لتلك المكالمة.

نقطة النهاية (Endpoint) حقول usage تضيفها النماذج المفتوحة الأوزان المستضافة
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • يحتوي usage على عدد الـ tokens التي استخدمها النموذج. أما المقدار المخصوم من رصيدك فليس في الرد: إنه العمود tokens المحتسبة في قائمة الطلبات في Keys & usage.
  • على /v1/messages مع نموذج مفتوح الأوزان مستضاف، يمثل input_tokens الجزء غير المخبأ من المدخلات، ويمثل cache_read_input_tokens الجزء المخبأ، ويكون cache_creation_input_tokens دائماً 0.
  • يحمل البث على /v1/chat/completions الكائن usage في آخر جزء قبل [DONE]. البث

عند نفاد الرصيد

الطلب الذي لا يتسع حجزه في رصيدك يُجاب عنه بالحالة 429 والنوع rate_limit_error والرسالة أدناه. ولا يُحتسب شيء. ويُرسل الرد نفسه عندما يكون الرصيد أكبر من الصفر لكنه أقل من ميزانية مخرجات الطلب.

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

على /v1/responses قد يحتوي الكائن error أيضاً على code وparam، وكلاهما null.

ما يمكنك فعله:

  • انتظر مخصصات الخطة التالية عند 00:00 UTC.
  • اشحن الرصيد. يُنفق الرصيد بعد مخصصات الخطة ولا تنتهي صلاحيته. شحن الرصيد
  • انتقل إلى خطة ذات مخصص يومي أكبر. تغيير الخطة
  • أرسل max_tokens أصغر إن بقي بعض الرصيد: فيصبح الحجز أصغر.

حصة مكالمات Shannon Coder

يُحتسب shannon-coder-1 على /v1/chat/completions و/v1/messages بالمكالمات لا بالـ tokens. تتضمن كل خطة عدداً من المكالمات لكل نافذة مدتها 4 ساعات. والطلب الواحد مكالمة واحدة.

الخطة المكالمات لكل نافذة من 4 ساعات
Free 3
Plus 20
Standard 40
Pro 60
  • تبدأ النوافذ عند 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. والمكالمات المتبقية في نهاية النافذة لا تُرحَّل.
  • تُحسب المكالمة عند قبول الطلب، قبل أن يجيب النموذج. والطلب الذي يفشل بعد ذلك يُحسب مكالمة أيضاً.
  • هذه المكالمات لا تحجز أي tokens ولا تخصم شيئاً من رصيدك. وتعرض قائمة الطلبات في Keys & usage عدد الـ tokens وقيمتها بالسعر المعلن.
  • القيمة الافتراضية لـ max_tokens في shannon-coder-1 على نقطتي النهاية هاتين هي 65,536.
  • عند نفاد المكالمات يكون الرد بالحالة 429 والنوع rate_limit_error والرسالة Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan.
  • على /v1/responses لا توجد حصة مكالمات لـ shannon-coder-1: بل يُحاسَب بالـ tokens من رصيدك بسعر $8.00 لكل 1M، مثل كل نموذج آخر.

الحماية من الإغراق

يستطيع الحساب إرسال 120 طلباً في الدقيقة. وهذا هو الحد الوحيد على معدل الطلبات، وهو نفسه في كل خطة. وُجد لمنع الإغراق، لا لإبطاء الاستخدام العادي.

  • الدقيقة نافذة ثابتة مدتها 60 ثانية تبدأ مع أول طلب لك. وعند انتهائها يبدأ العد من الصفر من جديد.
  • العد يكون لكل حساب، لا لكل مفتاح ولا لكل عنوان IP. تدوير المفتاح لا يفتح نافذة جديدة.
  • الطلب رقم 121 داخل النافذة يُجاب عنه بالحالة 429 والنوع rate_limit_error والرسالة Too many requests. Retry in <N>s. وتمثل N عدد الثواني حتى نهاية النافذة، من 1 إلى 60.
  • تُفحص الحماية من الإغراق قبل الرصيد. والطلب الذي ترفضه لا يحجز شيئاً ولا يكلّف شيئاً.
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
الطلب الحماية من الإغراق
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses يُحتسب، واحد لكل طلب.
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens لا يُحتسب.
shannon-coder-1 على /v1/chat/completions و/v1/messages يُحتسب بدلاً من ذلك ضمن حصة مكالمات Shannon Coder.
طلب أُجيب عنه بـ 401، أو بـ 400 بسبب model غير معروف لا يُحتسب.
طلب رفضته الحماية من الإغراق يُحتسب ضمن النافذة. ولا يُحتسب أي رصيد.

الطلبات المتوازية

لا حد لعدد الطلبات التي يفتحها الحساب في الوقت نفسه، ولا خطأ عند إرسال الطلبات بالتوازي. والطلبات التي لا يمكن أن تبدأ فوراً تنتظر في الطابور ويُجاب عنها بالتتابع.

  • يُحتسب كل طلب ضمن الـ 120 في الدقيقة عند وصوله، سواء انتهت الطلبات السابقة أم لا.
  • يحتفظ كل طلب بحجزه الخاص حتى ينتهي. عشرون طلباً مفتوحاً بميزانية المخرجات الافتراضية تحجز 20 × 4,096 = 81,920 token من الرصيد. وإذا كانت الحجوزات معاً أكبر من رصيدك، يحصل الطلب التالي على الرد Quota exceeded، حتى لو كانت المكالمات المنتهية ستكلّف أقل. وmax_tokens أصغر يحجز أقل.
  • الطلب بدون بث لا يرسل شيئاً حتى تكتمل إجابته، فاضبط في عميلك مهلة تغطي الانتظار. أما البث فيُبقي اتصاله مفتوحاً أثناء الانتظار. البث

حدود الطلب الواحد

الحد القيمة ينطبق على عند بلوغ الحد
نص الطلب 32 MiB (33,554,432 بايت) كل نقطة نهاية الحالة 413، النوع invalid_request_error.
ميزانية المخرجات: max_tokens وmax_completion_tokens وmax_output_tokens من 1 إلى 65,536. الافتراضي 4,096؛ وفي shannon-coder-1 على /v1/chat/completions و/v1/messages الافتراضي هو 65,536. كل نموذج، بوصفها المقدار المحجوز من رصيدك. وبوصفها حداً لطول الإجابة: النماذج المفتوحة الأوزان المستضافة وshannon-1.6-lite وshannon-1.6-pro وshannon-coder-1. القيمة خارج المدى تُنقل إلى أقرب طرف في المدى. دون خطأ.
تسلسلات الإيقاف: stop وstop_sequences 4 سلاسل النماذج المفتوحة الأوزان المستضافة تُستخدم أول 4 سلاسل غير فارغة.
صورة أو ملف يُعطى كعنوان URL 8 MiB، تُقرأ خلال 20 ثانية، وبحد أقصى 5 عمليات إعادة توجيه، وعنوان http أو https عام كل نقطة نهاية تقبل الصور أو الملفات يُجاب عن الطلب دون ذلك الجزء. دون خطأ.
صورة أو ملف يُرسل ضمن الطلب مباشرة (base64) لا حد خاصاً به. ويُحتسب ضمن نص الطلب البالغ 32 MiB. كل نقطة نهاية تقبل الصور أو الملفات الحالة 413 للطلب كله.
text في POST /v1/tokenize 4,000,000 بايت /v1/tokenize الحالة 413، النوع invalid_request_error، الرسالة text too long.
messages في POST /v1/tokenize ونص POST /v1/messages/count_tokens نص الطلب البالغ 32 MiB نقطتا نهاية العد كلتاهما الحالة 413.
نافذة السياق لكل نموذج: context_window في GET /v1/models كل نموذج ما يحدث للمحادثة الأطول يعتمد على النموذج. النماذج والأسعار
عمليات البحث على الويب (web_search: true) لكل خطة ويوم: Free 3، Plus 30، Standard 50، Pro 60. تُحتسب عملية بحث واحدة للطلب الذي وجد بحثه نتائج. الطلبات التي تضبط web_search: true عند نفادها يُجاب عن الطلب دون بحث. دون خطأ. بحث ويب مدمج

الأخطاء

ردود هذه الصفحة. على /v1/messages يُغلَّف الكائن error نفسه هكذا {"type": "error", "error": {…}}.

الحالة النوع الرسالة متى، وماذا تفعل
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan حجز الطلب لا يتسع في رصيدك. انتظر حتى 00:00 UTC، أو اشحن الرصيد، أو غيّر الخطة، أو أرسل max_tokens أصغر.
429 rate_limit_error Too many requests. Retry in <N>s. أكثر من 120 طلباً في الدقيقة الحالية. انتظر N ثانية ثم أعد الإرسال.
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan نفدت مكالمات Shannon Coder في نافذة الـ 4 ساعات الحالية.
429 rate_limit_error Shannon routes are temporarily busy. Please retry. لا يستطيع النموذج استقبال الطلب في هذه اللحظة. أعد إرساله بعد توقف قصير.
503 api_error Could not verify your quota right now. Please retry. تعذرت قراءة رصيدك. لا يُحتسب شيء؛ أعد إرسال الطلب. على /v1/responses مع نموذج Shannon تكون الحالة 500.
413 invalid_request_error نص الطلب أكبر من 32 MiB. في نقاط النهاية بصيغة OpenAI يحمل الكائن error القيمة code: "request_too_large".
413 invalid_request_error text too long text في POST /v1/tokenize أطول من 4,000,000 بايت.