কনটেন্টে যান
সীমা ও ব্যালেন্স

সীমা ও ব্যালেন্স

প্রতিটি রিকোয়েস্ট সমানভাবে সরবরাহ করা হয়। কোনো রেট টিয়ার নেই। আলাদা কোনো API কোটা নেই। আপনার tokens আপনি আগেই কিনেছেন — যত দ্রুত খুশি ব্যবহার করুন।

এই পেজে ব্যাখ্যা করা হয়েছে আপনার ব্যালেন্স কী দিয়ে তৈরি, একটি রিকোয়েস্ট কী সংরক্ষণ করে ও তার খরচ কত, আপনি কতগুলো রিকোয়েস্ট পাঠাতে পারেন, এবং একটি রিকোয়েস্ট যে কয়েকটি সীমায় পড়তে পারে।

1M tokens ব্যালেন্সের মূল্য
$5.00
দৈনিক এলাউন্স নবায়ন
00:00 UTC
ফ্লাড প্রোটেকশন, প্রতি অ্যাকাউন্টে
120 রিকোয়েস্ট / মিনিট

রিকোয়েস্ট কীভাবে সরবরাহ হয়

  • কোনো রেট টিয়ার নেই — একটি নিয়ম রিকোয়েস্ট কত দ্রুত আসতে পারবে তা সীমিত করে, এবং তা প্রতিটি অ্যাকাউন্ট ও প্রতিটি প্ল্যানে এক: প্রতি মিনিটে 120টি রিকোয়েস্ট। প্রতি মিনিটে tokens-এর কোনো সীমা নেই।
  • আলাদা কোনো API কোটা নেই — API চ্যাটের একই ব্যালেন্স খরচ করে। প্ল্যান আজকের এলাউন্সের আকার ঠিক করে। রিকোয়েস্টের হার ঠিক করে না।
  • যত দ্রুত খুশি — সমান্তরালে পাঠানো রিকোয়েস্ট গ্রহণ করা হয় এবং সারিতে অপেক্ষা করে। সমান্তরাল বলে সেগুলো প্রত্যাখ্যাত হয় না।

আপনার ব্যালেন্স

আপনার ব্যালেন্স tokens-এ গোনা হয়। 1,000,000 tokens ব্যালেন্সের মূল্য $5.00, এবং Models & pricing পেজের প্রতিটি দাম ওই মূল্যের বিপরীতে একটি হার।

যেকোনো মুহূর্তে ব্যালেন্স দুই অংশের যোগফল।

  • আজকের প্ল্যান এলাউন্স — আপনার প্ল্যান নির্ধারিত tokens-এর একটি সংখ্যা। এটি প্রতিদিন 00:00 UTC-তে নতুন হয়। দিনের শেষে যা বাকি থাকে তা পরের দিনে যায় না।
  • কেনা ক্রেডিট — প্যাক হিসেবে কেনা tokens। ক্রেডিটের মেয়াদ শেষ হয় না এবং Free সহ প্রতিটি প্ল্যানে কাজ করে।
প্ল্যান প্রতিদিন tokens মূল্য
Free 30,000 $0.15
Plus 80,000 $0.40
Standard 265,000 $1.325
Pro 665,000 $3.325
  • খরচের ক্রম — প্রতিটি রিকোয়েস্ট আগে আজকের প্ল্যান এলাউন্স খরচ করে। কেনা ক্রেডিট শুধু সেদিনের এলাউন্সের বাইরের অংশের জন্য ব্যবহার হয়।
  • চ্যাট ও API একই ব্যালেন্স ব্যবহার করে — প্রতি অ্যাকাউন্টে একটি ব্যালেন্স। API key তার মালিক অ্যাকাউন্টের ব্যালেন্স থেকে খরচ করে, চ্যাটের সমান দামে।
  • প্যাক — ক্রেডিট বিক্রি হয় 1,000,000 ($5.00), 2,000,000 ($10.00) ও 5,000,000 ($25.00) tokens-এর প্যাকে, অথবা 1,000,000 থেকে 100,000,000 tokens পর্যন্ত আপনার পছন্দের পরিমাণে, প্রতি 1,000,000-এ $5.00 হারে।

ক্রেডিট টপ-আপ প্ল্যান পরিবর্তন করুন

একটি রিকোয়েস্ট কী সংরক্ষণ করে এবং তার খরচ কত

  • সংরক্ষণ — রিকোয়েস্ট এলে সে আপনার ব্যালেন্স থেকে নিজের আউটপুট বাজেট সংরক্ষণ করে: /v1/chat/completions ও /v1/messages-এ max_tokens, /v1/responses-এ max_output_tokens। /v1/chat/completions max_completion_tokens-ও পড়ে। ডিফল্ট 4,096 এবং সীমা 1 থেকে 65,536।
  • গ্রহণ — সংরক্ষণ আপনার অবশিষ্ট ব্যালেন্সে ধরলেই কেবল রিকোয়েস্ট গ্রহণ করা হয়। ব্যালেন্স শূন্যের বেশি কিন্তু আউটপুট বাজেটের চেয়ে কম হলে Quota exceeded উত্তর আসে। বাকিটা ব্যবহার করতে ছোট max_tokens পাঠান।
  • নিষ্পত্তি — উত্তর সম্পূর্ণ হলে সংরক্ষণের জায়গায় প্রকৃত চার্জ বসে। চার্জ সংরক্ষণের চেয়ে কম বা বেশি হতে পারে।
  • ফেরত — এরর স্ট্যাটাসে শেষ হওয়া রিকোয়েস্ট তার সংরক্ষণ পুরোপুরি ফেরত দেয়।

প্রকৃত চার্জ মডেল পরিবারের ওপর নির্ভর করে।

মডেল কী চার্জ হয়
Shannon মডেল মডেলের প্রতি 1M-এর দামে usage.total_tokens। ইনপুট ও আউটপুটের একই হার।
হোস্টেড ওপেন-ওয়েট মডেল আনক্যাশড ইনপুট ইনপুট হারে, ক্যাশড ইনপুট ক্যাশড হারে, আউটপুট আউটপুট হারে।

USD পরিমাণটি আপনার ব্যালেন্স থেকে tokens-এ নেওয়া হয়, প্রতি 1,000,000-এ $5.00 হারে, পূর্ণ token-এ গোল করে।

POST /v1/tokenize বা POST /v1/messages/count_tokens দিয়ে tokens গোনা বিনামূল্যে এবং কিছু সংরক্ষণ করে না। Token গণনা

ব্যালেন্স ও ব্যবহার কোথায় দেখবেন

Keys & usage পেজ দেখায় আপনি এখন কত খরচ করতে পারেন, আজকের প্ল্যান এলাউন্স, আপনার কেনা ক্রেডিট এবং শেষ 30 দিনের API খরচ। তার নিচে আপনার key-র করা প্রতিটি রিকোয়েস্ট তালিকাভুক্ত থাকে: সময়, এন্ডপয়েন্ট, মডেল, ক্যাশড ইনপুট, বিল হওয়া tokens ও খরচ। Keys & usage

প্রতিটি উত্তরে ওই কলের token সংখ্যাসহ একটি usage অবজেক্টও থাকে।

এন্ডপয়েন্ট usage-এর ফিল্ড হোস্টেড ওপেন-ওয়েট মডেল যা যোগ করে
/v1/chat/completions prompt_tokens, completion_tokens, total_tokens prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens
/v1/messages input_tokens, output_tokens cache_read_input_tokens, cache_creation_input_tokens
/v1/responses input_tokens, output_tokens, total_tokens input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens
  • usage-এ মডেলের token সংখ্যা থাকে। আপনার ব্যালেন্স থেকে যা কাটা হলো তা উত্তরে নেই: সেটি Keys & usage-এর রিকোয়েস্ট তালিকার Billed tokens কলামে আছে।
  • হোস্টেড ওপেন-ওয়েট মডেলসহ /v1/messages-এ input_tokens ইনপুটের আনক্যাশড অংশ, cache_read_input_tokens ক্যাশড অংশ এবং cache_creation_input_tokens সবসময় 0।
  • /v1/chat/completions-এ স্ট্রিম [DONE]-এর আগে শেষ চাঙ্কে usage বহন করে। স্ট্রিমিং

ব্যালেন্স ফুরিয়ে গেলে

যে রিকোয়েস্টের সংরক্ষণ আপনার ব্যালেন্সে ধরে না তার উত্তর আসে স্ট্যাটাস 429, type rate_limit_error এবং নিচের বার্তা দিয়ে। কিছু চার্জ হয় না। ব্যালেন্স শূন্যের বেশি কিন্তু রিকোয়েস্টের আউটপুট বাজেটের চেয়ে কম হলেও একই উত্তর আসে।

{
  "error": {
    "type": "rate_limit_error",
    "message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
  }
}

/v1/responses-এ error অবজেক্টে code ও param-ও থাকতে পারে, দুটোই null।

আপনি যা করতে পারেন:

  • 00:00 UTC-তে পরবর্তী প্ল্যান এলাউন্সের জন্য অপেক্ষা করুন।
  • ক্রেডিট টপ-আপ করুন। ক্রেডিট প্ল্যান এলাউন্সের পরে খরচ হয় এবং এর মেয়াদ শেষ হয় না। ক্রেডিট টপ-আপ
  • বড় দৈনিক এলাউন্সের প্ল্যানে যান। প্ল্যান পরিবর্তন করুন
  • কিছু ব্যালেন্স বাকি থাকলে ছোট max_tokens পাঠান: তখন সংরক্ষণ ছোট হয়।

Shannon Coder কল এলাউন্স

/v1/chat/completions ও /v1/messages-এ shannon-coder-1 tokens-এ নয়, কলে গোনা হয়। প্রতিটি প্ল্যানে প্রতি 4 ঘণ্টার উইন্ডোতে কিছু কল অন্তর্ভুক্ত। একটি রিকোয়েস্ট একটি কল।

প্ল্যান প্রতি 4 ঘণ্টার উইন্ডোতে কল
Free 3
Plus 20
Standard 40
Pro 60
  • উইন্ডো শুরু হয় 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-তে। উইন্ডোর শেষে যে কল বাকি থাকে তা পরের উইন্ডোতে যায় না।
  • রিকোয়েস্ট গ্রহণের সময়, মডেল উত্তর দেওয়ার আগে, একটি কল গোনা হয়। পরে ব্যর্থ হওয়া রিকোয়েস্টও একটি কল হিসেবে গণ্য হয়।
  • এই কলগুলো কোনো tokens সংরক্ষণ করে না এবং আপনার ব্যালেন্স থেকে কিছু নেয় না। Keys & usage-এর রিকোয়েস্ট তালিকায় তাদের token সংখ্যা এবং তালিকাভুক্ত দামে তার মূল্য দেখা যায়।
  • এই দুটি এন্ডপয়েন্টে shannon-coder-1-এর ডিফল্ট max_tokens হলো 65,536।
  • কল শেষ হলে উত্তর হয় স্ট্যাটাস 429, type rate_limit_error, বার্তা Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan।
  • /v1/responses-এ shannon-coder-1-এর কোনো কল এলাউন্স নেই: অন্য প্রতিটি মডেলের মতো এটি আপনার ব্যালেন্স থেকে tokens-এ, প্রতি 1M-এ $8.00 হারে চার্জ হয়।

ফ্লাড প্রোটেকশন

একটি অ্যাকাউন্ট প্রতি মিনিটে 120টি রিকোয়েস্ট পাঠাতে পারে। রিকোয়েস্টের হারের ওপর এটিই একমাত্র সীমা, এবং প্রতিটি প্ল্যানে তা এক। এটি ফ্লাড ঠেকাতে আছে, স্বাভাবিক ব্যবহার ধীর করতে নয়।

  • মিনিটটি 60 সেকেন্ডের একটি স্থির উইন্ডো, যা আপনার প্রথম রিকোয়েস্টে খোলে। শেষ হলে গণনা আবার শূন্য থেকে শুরু হয়।
  • গণনা অ্যাকাউন্ট ধরে, key বা IP ঠিকানা ধরে নয়। key বদলালে নতুন উইন্ডো খোলে না।
  • উইন্ডোর ভেতরে 121তম রিকোয়েস্টের উত্তর আসে স্ট্যাটাস 429, type rate_limit_error এবং বার্তা Too many requests. Retry in <N>s. দিয়ে। N হলো উইন্ডো শেষ হতে বাকি সেকেন্ড, 1 থেকে 60।
  • ফ্লাড প্রোটেকশন ব্যালেন্সের আগে যাচাই হয়। সে যে রিকোয়েস্ট প্রত্যাখ্যান করে তা কিছু সংরক্ষণ করে না এবং কোনো খরচ হয় না।
{
  "error": {
    "type": "rate_limit_error",
    "message": "Too many requests. Retry in 37s."
  }
}
রিকোয়েস্ট ফ্লাড প্রোটেকশন
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses গোনা হয়, প্রতি রিকোয়েস্টে একটি।
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens গোনা হয় না।
/v1/chat/completions ও /v1/messages-এ shannon-coder-1 এর বদলে Shannon Coder কল এলাউন্সে গোনা হয়।
যে রিকোয়েস্টের উত্তর 401, অথবা অজানা model-এর জন্য 400 গোনা হয় না।
ফ্লাড প্রোটেকশন যে রিকোয়েস্ট প্রত্যাখ্যান করেছে উইন্ডোর গণনায় ধরা হয়। কিছু চার্জ হয় না।

সমান্তরাল রিকোয়েস্ট

একটি অ্যাকাউন্টের একসাথে কতগুলো রিকোয়েস্ট খোলা থাকতে পারে তার কোনো সীমা নেই, এবং সমান্তরালে রিকোয়েস্ট পাঠানোর জন্য কোনো এরর নেই। যেসব রিকোয়েস্ট সাথে সাথে শুরু হতে পারে না সেগুলো সারিতে অপেক্ষা করে এবং পালাক্রমে উত্তর পায়।

  • প্রতিটি রিকোয়েস্ট এসে পৌঁছানোর সময়ই প্রতি মিনিটে 120-র গণনায় ধরা হয়, আগের রিকোয়েস্ট শেষ হোক বা না হোক।
  • প্রতিটি রিকোয়েস্ট শেষ না হওয়া পর্যন্ত নিজের সংরক্ষণ ধরে রাখে। ডিফল্ট আউটপুট বাজেটসহ বিশটি খোলা রিকোয়েস্ট 20 × 4,096 = 81,920 tokens ব্যালেন্স ধরে রাখে। সংরক্ষণগুলো মিলে ব্যালেন্সের চেয়ে বড় হলে পরের রিকোয়েস্ট Quota exceeded উত্তর পায়, যদিও শেষ হওয়া কলগুলোর খরচ কম হতো। ছোট max_tokens কম ধরে রাখে।
  • স্ট্রিম ছাড়া রিকোয়েস্ট উত্তর সম্পূর্ণ না হওয়া পর্যন্ত কিছু পাঠায় না, তাই আপনার ক্লায়েন্টে এমন টাইমআউট দিন যা এই অপেক্ষা পুষিয়ে নেয়। স্ট্রিম অপেক্ষার সময় সংযোগ খোলা রাখে। স্ট্রিমিং

একটি রিকোয়েস্টের সীমা

সীমা মান যেখানে প্রযোজ্য সীমায় পৌঁছালে
রিকোয়েস্ট বডি 32 MiB (33,554,432 বাইট) প্রতিটি এন্ডপয়েন্ট স্ট্যাটাস 413, type invalid_request_error।
আউটপুট বাজেট: max_tokens, max_completion_tokens, max_output_tokens 1 থেকে 65,536। ডিফল্ট 4,096; /v1/chat/completions ও /v1/messages-এ shannon-coder-1-এর ডিফল্ট 65,536। প্রতিটি মডেল, আপনার ব্যালেন্স থেকে সংরক্ষিত পরিমাণ হিসেবে। উত্তরের দৈর্ঘ্যের সীমা হিসেবে: হোস্টেড ওপেন-ওয়েট মডেল, shannon-1.6-lite, shannon-1.6-pro ও shannon-coder-1। সীমার বাইরের মান সীমার নিকটতম প্রান্তে সরানো হয়। কোনো এরর নেই।
স্টপ সিকোয়েন্স: stop, stop_sequences 4টি string হোস্টেড ওপেন-ওয়েট মডেল প্রথম 4টি খালি নয় এমন string ব্যবহার হয়।
URL হিসেবে দেওয়া ইমেজ বা ফাইল 8 MiB, 20 সেকেন্ডের মধ্যে পড়া, সর্বোচ্চ 5টি রিডিরেক্ট, পাবলিক http বা https ঠিকানা ইমেজ বা ফাইল নেয় এমন প্রতিটি এন্ডপয়েন্ট রিকোয়েস্টের উত্তর সেই অংশ ছাড়াই দেওয়া হয়। কোনো এরর নেই।
ইনলাইন পাঠানো ইমেজ বা ফাইল (base64) নিজস্ব কোনো সীমা নেই। এটি 32 MiB রিকোয়েস্ট বডির গণনায় পড়ে। ইমেজ বা ফাইল নেয় এমন প্রতিটি এন্ডপয়েন্ট পুরো রিকোয়েস্টের জন্য স্ট্যাটাস 413।
POST /v1/tokenize-এর text 4,000,000 বাইট /v1/tokenize স্ট্যাটাস 413, type invalid_request_error, বার্তা text too long।
POST /v1/tokenize-এর messages এবং POST /v1/messages/count_tokens-এর বডি 32 MiB রিকোয়েস্ট বডি গণনার দুটি এন্ডপয়েন্টই স্ট্যাটাস 413।
কনটেক্সট উইন্ডো মডেল অনুযায়ী: GET /v1/models-এর context_window প্রতিটি মডেল দীর্ঘতর কথোপকথনের কী হবে তা মডেলের ওপর নির্ভর করে। মডেল ও মূল্য
ওয়েব সার্চ (web_search: true) প্ল্যান ও দিন অনুযায়ী: Free 3, Plus 30, Standard 50, Pro 60। যে রিকোয়েস্টের সার্চে ফলাফল পাওয়া গেছে তার জন্য একটি সার্চ গোনা হয়। যেসব রিকোয়েস্ট web_search: true দেয় কিছু বাকি না থাকলে রিকোয়েস্টের উত্তর সার্চ ছাড়া দেওয়া হয়। কোনো এরর নেই। ওয়েব সার্চ

এরর

এই পেজের উত্তরগুলো। /v1/messages-এ একই error অবজেক্ট {"type": "error", "error": {…}} হিসেবে মোড়ানো থাকে।

স্ট্যাটাস টাইপ বার্তা কখন, এবং কী করবেন
429 rate_limit_error Quota exceeded. Upgrade your plan at shannon-ai.com/plan রিকোয়েস্টের সংরক্ষণ আপনার ব্যালেন্সে ধরে না। 00:00 UTC পর্যন্ত অপেক্ষা করুন, ক্রেডিট টপ-আপ করুন, প্ল্যান বদলান, অথবা ছোট max_tokens পাঠান।
429 rate_limit_error Too many requests. Retry in <N>s. বর্তমান মিনিটে 120টির বেশি রিকোয়েস্ট। N সেকেন্ড অপেক্ষা করে আবার পাঠান।
429 rate_limit_error Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan বর্তমান 4 ঘণ্টার উইন্ডোর Shannon Coder কল শেষ হয়ে গেছে।
429 rate_limit_error Shannon routes are temporarily busy. Please retry. মডেল এই মুহূর্তে রিকোয়েস্ট নিতে পারছে না। একটু থেমে আবার পাঠান।
503 api_error Could not verify your quota right now. Please retry. আপনার ব্যালেন্স পড়া যায়নি। কিছু চার্জ হয়নি; রিকোয়েস্ট আবার পাঠান। Shannon মডেলসহ /v1/responses-এ স্ট্যাটাস 500।
413 invalid_request_error রিকোয়েস্ট বডি 32 MiB-এর চেয়ে বড়। OpenAI-ফরম্যাট এন্ডপয়েন্টে error অবজেক্টে code: "request_too_large" থাকে।
413 invalid_request_error text too long POST /v1/tokenize-এর text 4,000,000 বাইটের চেয়ে দীর্ঘ।