الحدود والرصيد
كل طلب يُخدَّم بالتساوي. لا شرائح لمعدل الطلبات. ولا حصة API منفصلة. لقد دفعت ثمن tokens مسبقاً، فاستخدمها بالسرعة التي تشاء.
تشرح هذه الصفحة مما يتكوّن رصيدك، وما الذي يحجزه الطلب الواحد وكم يكلّف، وكم طلباً يمكنك إرساله، والحدود القليلة التي قد يواجهها الطلب الواحد.
- قيمة 1M token من الرصيد
- $5.00
- تجدد المخصص اليومي
- 00:00 UTC
- الحماية من الإغراق، لكل حساب
- 120 طلب / دقيقة
كيف تُخدَّم الطلبات
- لا شرائح لمعدل الطلبات — قاعدة واحدة تحدد سرعة وصول الطلبات، وهي نفسها لكل حساب ولكل خطة: 120 طلباً في الدقيقة. ولا حد على الـ tokens في الدقيقة.
- لا حصة API منفصلة — تُنفق API الرصيد نفسه الذي تنفقه الدردشة. وتحدد الخطة حجم مخصصات اليوم، ولا تحدد معدل الطلبات.
- بالسرعة التي تشاء — الطلبات المرسلة بالتوازي تُقبل وتنتظر في الطابور. ولا تُرفض لمجرد أنها متوازية.
رصيدك
يُحسب رصيدك بالـ tokens. وقيمة 1,000,000 token من الرصيد تساوي $5.00، وكل سعر في صفحة Models & pricing هو معدل مقابل هذه القيمة.
في أي لحظة يكون الرصيد مجموع جزأين.
- مخصصات الخطة لليوم — عدد من الـ tokens تحدده خطتك. يتجدد كل يوم عند 00:00 UTC. وما يتبقى في نهاية اليوم لا يُرحَّل.
- الرصيد المشتري — الـ tokens التي اشتريتها كحزمة. لا تنتهي صلاحية الرصيد، ويعمل مع كل خطة، بما فيها Free.
| الخطة | tokens في اليوم | القيمة |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- ترتيب الإنفاق — يُنفق كل طلب مخصصات الخطة لليوم أولاً. ولا يُستخدم الرصيد المشتري إلا لما يتجاوز المخصصات في ذلك اليوم.
- الدردشة وAPI يتشاركانه — يوجد رصيد واحد لكل حساب. ويُنفق مفتاح API من رصيد الحساب الذي يملكه، بالأسعار نفسها المعتمدة في الدردشة.
- الحزم — يُباع الرصيد في حزم من 1,000,000 ($5.00) و2,000,000 ($10.00) و5,000,000 ($25.00) token، أو بمبلغ تختاره من 1,000,000 إلى 100,000,000 token بسعر $5.00 لكل 1,000,000.
ما يحجزه الطلب وما يكلّفه
- الحجز — عند وصول الطلب يحجز ميزانية مخرجاته من رصيدك:
max_tokensعلى/v1/chat/completionsو/v1/messages، وmax_output_tokensعلى/v1/responses. كما يقرأ/v1/chat/completionsالحقلmax_completion_tokens. القيمة الافتراضية 4,096 والمدى من 1 إلى 65,536. - القبول — يُقبل الطلب فقط إذا كان الحجز ضمن ما تبقى من رصيدك. والرصيد الذي يزيد على الصفر لكنه أقل من ميزانية المخرجات يحصل على الرد
Quota exceeded. أرسلmax_tokensأصغر لاستخدام المتبقي. - التسوية — عند اكتمال الإجابة يُستبدل الحجز بالتكلفة الفعلية. وقد تكون التكلفة أقل من الحجز أو أعلى منه.
- الإرجاع — الطلب الذي ينتهي بحالة خطأ يُعاد حجزه كاملاً.
تعتمد التكلفة الفعلية على عائلة النموذج.
| النماذج | ما يُحتسب |
|---|---|
| نماذج Shannon | usage.total_tokens بسعر النموذج لكل 1M. وللمدخلات والمخرجات سعر واحد. |
| النماذج المفتوحة الأوزان المستضافة | المدخلات غير المخبأة بسعر المدخلات، والمدخلات المخبأة بسعر المخبأ، والمخرجات بسعر المخرجات. |
يُخصم المبلغ بالدولار من رصيدك بالـ tokens بسعر $5.00 لكل 1,000,000، مقرباً إلى token كامل.
عدّ الـ tokens عبر POST /v1/tokenize أو POST /v1/messages/count_tokens مجاني ولا يحجز شيئاً. عدّ الـ tokens
أين ترى الرصيد والاستخدام
تعرض صفحة Keys & usage ما يمكنك إنفاقه الآن، ومخصصات الخطة لليوم، ورصيدك المشتري، وإنفاق API خلال آخر 30 يوماً. وتحتها قائمة بكل طلب أرسله مفتاحك: الوقت ونقطة النهاية والنموذج والمدخلات المخبأة والـ tokens المحتسبة والتكلفة. المفاتيح والاستخدام
يحمل كل رد أيضاً كائن usage فيه عدد الـ tokens لتلك المكالمة.
| نقطة النهاية (Endpoint) | حقول usage | تضيفها النماذج المفتوحة الأوزان المستضافة |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
- يحتوي
usageعلى عدد الـ tokens التي استخدمها النموذج. أما المقدار المخصوم من رصيدك فليس في الرد: إنه العمود tokens المحتسبة في قائمة الطلبات في Keys & usage. - على
/v1/messagesمع نموذج مفتوح الأوزان مستضاف، يمثلinput_tokensالجزء غير المخبأ من المدخلات، ويمثلcache_read_input_tokensالجزء المخبأ، ويكونcache_creation_input_tokensدائماً0. - يحمل البث على
/v1/chat/completionsالكائنusageفي آخر جزء قبل[DONE]. البث
عند نفاد الرصيد
الطلب الذي لا يتسع حجزه في رصيدك يُجاب عنه بالحالة 429 والنوع rate_limit_error والرسالة أدناه. ولا يُحتسب شيء. ويُرسل الرد نفسه عندما يكون الرصيد أكبر من الصفر لكنه أقل من ميزانية مخرجات الطلب.
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} على /v1/responses قد يحتوي الكائن error أيضاً على code وparam، وكلاهما null.
ما يمكنك فعله:
- انتظر مخصصات الخطة التالية عند 00:00 UTC.
- اشحن الرصيد. يُنفق الرصيد بعد مخصصات الخطة ولا تنتهي صلاحيته. شحن الرصيد
- انتقل إلى خطة ذات مخصص يومي أكبر. تغيير الخطة
- أرسل
max_tokensأصغر إن بقي بعض الرصيد: فيصبح الحجز أصغر.
حصة مكالمات Shannon Coder
يُحتسب shannon-coder-1 على /v1/chat/completions و/v1/messages بالمكالمات لا بالـ tokens. تتضمن كل خطة عدداً من المكالمات لكل نافذة مدتها 4 ساعات. والطلب الواحد مكالمة واحدة.
| الخطة | المكالمات لكل نافذة من 4 ساعات |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- تبدأ النوافذ عند 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC. والمكالمات المتبقية في نهاية النافذة لا تُرحَّل.
- تُحسب المكالمة عند قبول الطلب، قبل أن يجيب النموذج. والطلب الذي يفشل بعد ذلك يُحسب مكالمة أيضاً.
- هذه المكالمات لا تحجز أي tokens ولا تخصم شيئاً من رصيدك. وتعرض قائمة الطلبات في Keys & usage عدد الـ tokens وقيمتها بالسعر المعلن.
- القيمة الافتراضية لـ
max_tokensفيshannon-coder-1على نقطتي النهاية هاتين هي 65,536. - عند نفاد المكالمات يكون الرد بالحالة
429والنوعrate_limit_errorوالرسالةShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan. - على
/v1/responsesلا توجد حصة مكالمات لـshannon-coder-1: بل يُحاسَب بالـ tokens من رصيدك بسعر $8.00 لكل 1M، مثل كل نموذج آخر.
الحماية من الإغراق
يستطيع الحساب إرسال 120 طلباً في الدقيقة. وهذا هو الحد الوحيد على معدل الطلبات، وهو نفسه في كل خطة. وُجد لمنع الإغراق، لا لإبطاء الاستخدام العادي.
- الدقيقة نافذة ثابتة مدتها 60 ثانية تبدأ مع أول طلب لك. وعند انتهائها يبدأ العد من الصفر من جديد.
- العد يكون لكل حساب، لا لكل مفتاح ولا لكل عنوان IP. تدوير المفتاح لا يفتح نافذة جديدة.
- الطلب رقم 121 داخل النافذة يُجاب عنه بالحالة
429والنوعrate_limit_errorوالرسالةToo many requests. Retry in <N>s.وتمثلNعدد الثواني حتى نهاية النافذة، من 1 إلى 60. - تُفحص الحماية من الإغراق قبل الرصيد. والطلب الذي ترفضه لا يحجز شيئاً ولا يكلّف شيئاً.
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | الطلب | الحماية من الإغراق |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | يُحتسب، واحد لكل طلب. |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | لا يُحتسب. |
shannon-coder-1 على /v1/chat/completions و/v1/messages | يُحتسب بدلاً من ذلك ضمن حصة مكالمات Shannon Coder. |
طلب أُجيب عنه بـ 401، أو بـ 400 بسبب model غير معروف | لا يُحتسب. |
| طلب رفضته الحماية من الإغراق | يُحتسب ضمن النافذة. ولا يُحتسب أي رصيد. |
الطلبات المتوازية
لا حد لعدد الطلبات التي يفتحها الحساب في الوقت نفسه، ولا خطأ عند إرسال الطلبات بالتوازي. والطلبات التي لا يمكن أن تبدأ فوراً تنتظر في الطابور ويُجاب عنها بالتتابع.
- يُحتسب كل طلب ضمن الـ 120 في الدقيقة عند وصوله، سواء انتهت الطلبات السابقة أم لا.
- يحتفظ كل طلب بحجزه الخاص حتى ينتهي. عشرون طلباً مفتوحاً بميزانية المخرجات الافتراضية تحجز 20 × 4,096 = 81,920 token من الرصيد. وإذا كانت الحجوزات معاً أكبر من رصيدك، يحصل الطلب التالي على الرد
Quota exceeded، حتى لو كانت المكالمات المنتهية ستكلّف أقل. وmax_tokensأصغر يحجز أقل. - الطلب بدون بث لا يرسل شيئاً حتى تكتمل إجابته، فاضبط في عميلك مهلة تغطي الانتظار. أما البث فيُبقي اتصاله مفتوحاً أثناء الانتظار. البث
حدود الطلب الواحد
| الحد | القيمة | ينطبق على | عند بلوغ الحد |
|---|---|---|---|
| نص الطلب | 32 MiB (33,554,432 بايت) | كل نقطة نهاية | الحالة 413، النوع invalid_request_error. |
ميزانية المخرجات: max_tokens وmax_completion_tokens وmax_output_tokens | من 1 إلى 65,536. الافتراضي 4,096؛ وفي shannon-coder-1 على /v1/chat/completions و/v1/messages الافتراضي هو 65,536. | كل نموذج، بوصفها المقدار المحجوز من رصيدك. وبوصفها حداً لطول الإجابة: النماذج المفتوحة الأوزان المستضافة وshannon-1.6-lite وshannon-1.6-pro وshannon-coder-1. | القيمة خارج المدى تُنقل إلى أقرب طرف في المدى. دون خطأ. |
تسلسلات الإيقاف: stop وstop_sequences | 4 سلاسل | النماذج المفتوحة الأوزان المستضافة | تُستخدم أول 4 سلاسل غير فارغة. |
| صورة أو ملف يُعطى كعنوان URL | 8 MiB، تُقرأ خلال 20 ثانية، وبحد أقصى 5 عمليات إعادة توجيه، وعنوان http أو https عام | كل نقطة نهاية تقبل الصور أو الملفات | يُجاب عن الطلب دون ذلك الجزء. دون خطأ. |
| صورة أو ملف يُرسل ضمن الطلب مباشرة (base64) | لا حد خاصاً به. ويُحتسب ضمن نص الطلب البالغ 32 MiB. | كل نقطة نهاية تقبل الصور أو الملفات | الحالة 413 للطلب كله. |
text في POST /v1/tokenize | 4,000,000 بايت | /v1/tokenize | الحالة 413، النوع invalid_request_error، الرسالة text too long. |
messages في POST /v1/tokenize ونص POST /v1/messages/count_tokens | نص الطلب البالغ 32 MiB | نقطتا نهاية العد كلتاهما | الحالة 413. |
| نافذة السياق | لكل نموذج: context_window في GET /v1/models | كل نموذج | ما يحدث للمحادثة الأطول يعتمد على النموذج. النماذج والأسعار |
عمليات البحث على الويب (web_search: true) | لكل خطة ويوم: Free 3، Plus 30، Standard 50، Pro 60. تُحتسب عملية بحث واحدة للطلب الذي وجد بحثه نتائج. | الطلبات التي تضبط web_search: true | عند نفادها يُجاب عن الطلب دون بحث. دون خطأ. بحث ويب مدمج |
الأخطاء
ردود هذه الصفحة. على /v1/messages يُغلَّف الكائن error نفسه هكذا {"type": "error", "error": {…}}.
| الحالة | النوع | الرسالة | متى، وماذا تفعل |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | حجز الطلب لا يتسع في رصيدك. انتظر حتى 00:00 UTC، أو اشحن الرصيد، أو غيّر الخطة، أو أرسل max_tokens أصغر. |
429 | rate_limit_error | Too many requests. Retry in <N>s. | أكثر من 120 طلباً في الدقيقة الحالية. انتظر N ثانية ثم أعد الإرسال. |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | نفدت مكالمات Shannon Coder في نافذة الـ 4 ساعات الحالية. |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | لا يستطيع النموذج استقبال الطلب في هذه اللحظة. أعد إرساله بعد توقف قصير. |
503 | api_error | Could not verify your quota right now. Please retry. | تعذرت قراءة رصيدك. لا يُحتسب شيء؛ أعد إرسال الطلب. على /v1/responses مع نموذج Shannon تكون الحالة 500. |
413 | invalid_request_error | نص الطلب أكبر من 32 MiB. في نقاط النهاية بصيغة OpenAI يحمل الكائن error القيمة code: "request_too_large". | |
413 | invalid_request_error | text too long | text في POST /v1/tokenize أطول من 4,000,000 بايت. |