সীমা ও ব্যালেন্স
প্রতিটি রিকোয়েস্ট সমানভাবে সরবরাহ করা হয়। কোনো রেট টিয়ার নেই। আলাদা কোনো API কোটা নেই। আপনার tokens আপনি আগেই কিনেছেন — যত দ্রুত খুশি ব্যবহার করুন।
এই পেজে ব্যাখ্যা করা হয়েছে আপনার ব্যালেন্স কী দিয়ে তৈরি, একটি রিকোয়েস্ট কী সংরক্ষণ করে ও তার খরচ কত, আপনি কতগুলো রিকোয়েস্ট পাঠাতে পারেন, এবং একটি রিকোয়েস্ট যে কয়েকটি সীমায় পড়তে পারে।
- 1M tokens ব্যালেন্সের মূল্য
- $5.00
- দৈনিক এলাউন্স নবায়ন
- 00:00 UTC
- ফ্লাড প্রোটেকশন, প্রতি অ্যাকাউন্টে
- 120 রিকোয়েস্ট / মিনিট
রিকোয়েস্ট কীভাবে সরবরাহ হয়
- কোনো রেট টিয়ার নেই — একটি নিয়ম রিকোয়েস্ট কত দ্রুত আসতে পারবে তা সীমিত করে, এবং তা প্রতিটি অ্যাকাউন্ট ও প্রতিটি প্ল্যানে এক: প্রতি মিনিটে 120টি রিকোয়েস্ট। প্রতি মিনিটে tokens-এর কোনো সীমা নেই।
- আলাদা কোনো API কোটা নেই — API চ্যাটের একই ব্যালেন্স খরচ করে। প্ল্যান আজকের এলাউন্সের আকার ঠিক করে। রিকোয়েস্টের হার ঠিক করে না।
- যত দ্রুত খুশি — সমান্তরালে পাঠানো রিকোয়েস্ট গ্রহণ করা হয় এবং সারিতে অপেক্ষা করে। সমান্তরাল বলে সেগুলো প্রত্যাখ্যাত হয় না।
আপনার ব্যালেন্স
আপনার ব্যালেন্স tokens-এ গোনা হয়। 1,000,000 tokens ব্যালেন্সের মূল্য $5.00, এবং Models & pricing পেজের প্রতিটি দাম ওই মূল্যের বিপরীতে একটি হার।
যেকোনো মুহূর্তে ব্যালেন্স দুই অংশের যোগফল।
- আজকের প্ল্যান এলাউন্স — আপনার প্ল্যান নির্ধারিত tokens-এর একটি সংখ্যা। এটি প্রতিদিন 00:00 UTC-তে নতুন হয়। দিনের শেষে যা বাকি থাকে তা পরের দিনে যায় না।
- কেনা ক্রেডিট — প্যাক হিসেবে কেনা tokens। ক্রেডিটের মেয়াদ শেষ হয় না এবং Free সহ প্রতিটি প্ল্যানে কাজ করে।
| প্ল্যান | প্রতিদিন tokens | মূল্য |
|---|---|---|
| Free | 30,000 | $0.15 |
| Plus | 80,000 | $0.40 |
| Standard | 265,000 | $1.325 |
| Pro | 665,000 | $3.325 |
- খরচের ক্রম — প্রতিটি রিকোয়েস্ট আগে আজকের প্ল্যান এলাউন্স খরচ করে। কেনা ক্রেডিট শুধু সেদিনের এলাউন্সের বাইরের অংশের জন্য ব্যবহার হয়।
- চ্যাট ও API একই ব্যালেন্স ব্যবহার করে — প্রতি অ্যাকাউন্টে একটি ব্যালেন্স। API key তার মালিক অ্যাকাউন্টের ব্যালেন্স থেকে খরচ করে, চ্যাটের সমান দামে।
- প্যাক — ক্রেডিট বিক্রি হয় 1,000,000 ($5.00), 2,000,000 ($10.00) ও 5,000,000 ($25.00) tokens-এর প্যাকে, অথবা 1,000,000 থেকে 100,000,000 tokens পর্যন্ত আপনার পছন্দের পরিমাণে, প্রতি 1,000,000-এ $5.00 হারে।
ক্রেডিট টপ-আপ প্ল্যান পরিবর্তন করুন
একটি রিকোয়েস্ট কী সংরক্ষণ করে এবং তার খরচ কত
- সংরক্ষণ — রিকোয়েস্ট এলে সে আপনার ব্যালেন্স থেকে নিজের আউটপুট বাজেট সংরক্ষণ করে:
/v1/chat/completionsও/v1/messages-এmax_tokens,/v1/responses-এmax_output_tokens।/v1/chat/completionsmax_completion_tokens-ও পড়ে। ডিফল্ট 4,096 এবং সীমা 1 থেকে 65,536। - গ্রহণ — সংরক্ষণ আপনার অবশিষ্ট ব্যালেন্সে ধরলেই কেবল রিকোয়েস্ট গ্রহণ করা হয়। ব্যালেন্স শূন্যের বেশি কিন্তু আউটপুট বাজেটের চেয়ে কম হলে
Quota exceededউত্তর আসে। বাকিটা ব্যবহার করতে ছোটmax_tokensপাঠান। - নিষ্পত্তি — উত্তর সম্পূর্ণ হলে সংরক্ষণের জায়গায় প্রকৃত চার্জ বসে। চার্জ সংরক্ষণের চেয়ে কম বা বেশি হতে পারে।
- ফেরত — এরর স্ট্যাটাসে শেষ হওয়া রিকোয়েস্ট তার সংরক্ষণ পুরোপুরি ফেরত দেয়।
প্রকৃত চার্জ মডেল পরিবারের ওপর নির্ভর করে।
| মডেল | কী চার্জ হয় |
|---|---|
| Shannon মডেল | মডেলের প্রতি 1M-এর দামে usage.total_tokens। ইনপুট ও আউটপুটের একই হার। |
| হোস্টেড ওপেন-ওয়েট মডেল | আনক্যাশড ইনপুট ইনপুট হারে, ক্যাশড ইনপুট ক্যাশড হারে, আউটপুট আউটপুট হারে। |
USD পরিমাণটি আপনার ব্যালেন্স থেকে tokens-এ নেওয়া হয়, প্রতি 1,000,000-এ $5.00 হারে, পূর্ণ token-এ গোল করে।
POST /v1/tokenize বা POST /v1/messages/count_tokens দিয়ে tokens গোনা বিনামূল্যে এবং কিছু সংরক্ষণ করে না। Token গণনা
ব্যালেন্স ও ব্যবহার কোথায় দেখবেন
Keys & usage পেজ দেখায় আপনি এখন কত খরচ করতে পারেন, আজকের প্ল্যান এলাউন্স, আপনার কেনা ক্রেডিট এবং শেষ 30 দিনের API খরচ। তার নিচে আপনার key-র করা প্রতিটি রিকোয়েস্ট তালিকাভুক্ত থাকে: সময়, এন্ডপয়েন্ট, মডেল, ক্যাশড ইনপুট, বিল হওয়া tokens ও খরচ। Keys & usage
প্রতিটি উত্তরে ওই কলের token সংখ্যাসহ একটি usage অবজেক্টও থাকে।
| এন্ডপয়েন্ট | usage-এর ফিল্ড | হোস্টেড ওপেন-ওয়েট মডেল যা যোগ করে |
|---|---|---|
/v1/chat/completions | prompt_tokens, completion_tokens, total_tokens | prompt_tokens_details.cached_tokens, completion_tokens_details.reasoning_tokens |
/v1/messages | input_tokens, output_tokens | cache_read_input_tokens, cache_creation_input_tokens |
/v1/responses | input_tokens, output_tokens, total_tokens | input_tokens_details.cached_tokens, output_tokens_details.reasoning_tokens |
usage-এ মডেলের token সংখ্যা থাকে। আপনার ব্যালেন্স থেকে যা কাটা হলো তা উত্তরে নেই: সেটি Keys & usage-এর রিকোয়েস্ট তালিকার Billed tokens কলামে আছে।- হোস্টেড ওপেন-ওয়েট মডেলসহ
/v1/messages-এinput_tokensইনপুটের আনক্যাশড অংশ,cache_read_input_tokensক্যাশড অংশ এবংcache_creation_input_tokensসবসময়0। -
/v1/chat/completions-এ স্ট্রিম[DONE]-এর আগে শেষ চাঙ্কেusageবহন করে। স্ট্রিমিং
ব্যালেন্স ফুরিয়ে গেলে
যে রিকোয়েস্টের সংরক্ষণ আপনার ব্যালেন্সে ধরে না তার উত্তর আসে স্ট্যাটাস 429, type rate_limit_error এবং নিচের বার্তা দিয়ে। কিছু চার্জ হয় না। ব্যালেন্স শূন্যের বেশি কিন্তু রিকোয়েস্টের আউটপুট বাজেটের চেয়ে কম হলেও একই উত্তর আসে।
{
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Quota exceeded. Upgrade your plan at shannon-ai.com/plan"
}
} /v1/responses-এ error অবজেক্টে code ও param-ও থাকতে পারে, দুটোই null।
আপনি যা করতে পারেন:
- 00:00 UTC-তে পরবর্তী প্ল্যান এলাউন্সের জন্য অপেক্ষা করুন।
- ক্রেডিট টপ-আপ করুন। ক্রেডিট প্ল্যান এলাউন্সের পরে খরচ হয় এবং এর মেয়াদ শেষ হয় না। ক্রেডিট টপ-আপ
- বড় দৈনিক এলাউন্সের প্ল্যানে যান। প্ল্যান পরিবর্তন করুন
- কিছু ব্যালেন্স বাকি থাকলে ছোট
max_tokensপাঠান: তখন সংরক্ষণ ছোট হয়।
Shannon Coder কল এলাউন্স
/v1/chat/completions ও /v1/messages-এ shannon-coder-1 tokens-এ নয়, কলে গোনা হয়। প্রতিটি প্ল্যানে প্রতি 4 ঘণ্টার উইন্ডোতে কিছু কল অন্তর্ভুক্ত। একটি রিকোয়েস্ট একটি কল।
| প্ল্যান | প্রতি 4 ঘণ্টার উইন্ডোতে কল |
|---|---|
| Free | 3 |
| Plus | 20 |
| Standard | 40 |
| Pro | 60 |
- উইন্ডো শুরু হয় 00:00, 04:00, 08:00, 12:00, 16:00, 20:00 UTC-তে। উইন্ডোর শেষে যে কল বাকি থাকে তা পরের উইন্ডোতে যায় না।
- রিকোয়েস্ট গ্রহণের সময়, মডেল উত্তর দেওয়ার আগে, একটি কল গোনা হয়। পরে ব্যর্থ হওয়া রিকোয়েস্টও একটি কল হিসেবে গণ্য হয়।
- এই কলগুলো কোনো tokens সংরক্ষণ করে না এবং আপনার ব্যালেন্স থেকে কিছু নেয় না। Keys & usage-এর রিকোয়েস্ট তালিকায় তাদের token সংখ্যা এবং তালিকাভুক্ত দামে তার মূল্য দেখা যায়।
- এই দুটি এন্ডপয়েন্টে
shannon-coder-1-এর ডিফল্টmax_tokensহলো 65,536। - কল শেষ হলে উত্তর হয় স্ট্যাটাস
429, typerate_limit_error, বার্তাShannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan। /v1/responses-এshannon-coder-1-এর কোনো কল এলাউন্স নেই: অন্য প্রতিটি মডেলের মতো এটি আপনার ব্যালেন্স থেকে tokens-এ, প্রতি 1M-এ $8.00 হারে চার্জ হয়।
ফ্লাড প্রোটেকশন
একটি অ্যাকাউন্ট প্রতি মিনিটে 120টি রিকোয়েস্ট পাঠাতে পারে। রিকোয়েস্টের হারের ওপর এটিই একমাত্র সীমা, এবং প্রতিটি প্ল্যানে তা এক। এটি ফ্লাড ঠেকাতে আছে, স্বাভাবিক ব্যবহার ধীর করতে নয়।
- মিনিটটি 60 সেকেন্ডের একটি স্থির উইন্ডো, যা আপনার প্রথম রিকোয়েস্টে খোলে। শেষ হলে গণনা আবার শূন্য থেকে শুরু হয়।
- গণনা অ্যাকাউন্ট ধরে, key বা IP ঠিকানা ধরে নয়। key বদলালে নতুন উইন্ডো খোলে না।
- উইন্ডোর ভেতরে 121তম রিকোয়েস্টের উত্তর আসে স্ট্যাটাস
429, typerate_limit_errorএবং বার্তাToo many requests. Retry in <N>s.দিয়ে।Nহলো উইন্ডো শেষ হতে বাকি সেকেন্ড, 1 থেকে 60। - ফ্লাড প্রোটেকশন ব্যালেন্সের আগে যাচাই হয়। সে যে রিকোয়েস্ট প্রত্যাখ্যান করে তা কিছু সংরক্ষণ করে না এবং কোনো খরচ হয় না।
{
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} {
"type": "error",
"error": {
"type": "rate_limit_error",
"message": "Too many requests. Retry in 37s."
}
} | রিকোয়েস্ট | ফ্লাড প্রোটেকশন |
|---|---|
POST /v1/chat/completions, POST /v1/messages, POST /v1/responses | গোনা হয়, প্রতি রিকোয়েস্টে একটি। |
GET /v1/models, POST /v1/tokenize, POST /v1/messages/count_tokens | গোনা হয় না। |
/v1/chat/completions ও /v1/messages-এ shannon-coder-1 | এর বদলে Shannon Coder কল এলাউন্সে গোনা হয়। |
যে রিকোয়েস্টের উত্তর 401, অথবা অজানা model-এর জন্য 400 | গোনা হয় না। |
| ফ্লাড প্রোটেকশন যে রিকোয়েস্ট প্রত্যাখ্যান করেছে | উইন্ডোর গণনায় ধরা হয়। কিছু চার্জ হয় না। |
সমান্তরাল রিকোয়েস্ট
একটি অ্যাকাউন্টের একসাথে কতগুলো রিকোয়েস্ট খোলা থাকতে পারে তার কোনো সীমা নেই, এবং সমান্তরালে রিকোয়েস্ট পাঠানোর জন্য কোনো এরর নেই। যেসব রিকোয়েস্ট সাথে সাথে শুরু হতে পারে না সেগুলো সারিতে অপেক্ষা করে এবং পালাক্রমে উত্তর পায়।
- প্রতিটি রিকোয়েস্ট এসে পৌঁছানোর সময়ই প্রতি মিনিটে 120-র গণনায় ধরা হয়, আগের রিকোয়েস্ট শেষ হোক বা না হোক।
- প্রতিটি রিকোয়েস্ট শেষ না হওয়া পর্যন্ত নিজের সংরক্ষণ ধরে রাখে। ডিফল্ট আউটপুট বাজেটসহ বিশটি খোলা রিকোয়েস্ট 20 × 4,096 = 81,920 tokens ব্যালেন্স ধরে রাখে। সংরক্ষণগুলো মিলে ব্যালেন্সের চেয়ে বড় হলে পরের রিকোয়েস্ট
Quota exceededউত্তর পায়, যদিও শেষ হওয়া কলগুলোর খরচ কম হতো। ছোটmax_tokensকম ধরে রাখে। - স্ট্রিম ছাড়া রিকোয়েস্ট উত্তর সম্পূর্ণ না হওয়া পর্যন্ত কিছু পাঠায় না, তাই আপনার ক্লায়েন্টে এমন টাইমআউট দিন যা এই অপেক্ষা পুষিয়ে নেয়। স্ট্রিম অপেক্ষার সময় সংযোগ খোলা রাখে। স্ট্রিমিং
একটি রিকোয়েস্টের সীমা
| সীমা | মান | যেখানে প্রযোজ্য | সীমায় পৌঁছালে |
|---|---|---|---|
| রিকোয়েস্ট বডি | 32 MiB (33,554,432 বাইট) | প্রতিটি এন্ডপয়েন্ট | স্ট্যাটাস 413, type invalid_request_error। |
আউটপুট বাজেট: max_tokens, max_completion_tokens, max_output_tokens | 1 থেকে 65,536। ডিফল্ট 4,096; /v1/chat/completions ও /v1/messages-এ shannon-coder-1-এর ডিফল্ট 65,536। | প্রতিটি মডেল, আপনার ব্যালেন্স থেকে সংরক্ষিত পরিমাণ হিসেবে। উত্তরের দৈর্ঘ্যের সীমা হিসেবে: হোস্টেড ওপেন-ওয়েট মডেল, shannon-1.6-lite, shannon-1.6-pro ও shannon-coder-1। | সীমার বাইরের মান সীমার নিকটতম প্রান্তে সরানো হয়। কোনো এরর নেই। |
স্টপ সিকোয়েন্স: stop, stop_sequences | 4টি string | হোস্টেড ওপেন-ওয়েট মডেল | প্রথম 4টি খালি নয় এমন string ব্যবহার হয়। |
| URL হিসেবে দেওয়া ইমেজ বা ফাইল | 8 MiB, 20 সেকেন্ডের মধ্যে পড়া, সর্বোচ্চ 5টি রিডিরেক্ট, পাবলিক http বা https ঠিকানা | ইমেজ বা ফাইল নেয় এমন প্রতিটি এন্ডপয়েন্ট | রিকোয়েস্টের উত্তর সেই অংশ ছাড়াই দেওয়া হয়। কোনো এরর নেই। |
| ইনলাইন পাঠানো ইমেজ বা ফাইল (base64) | নিজস্ব কোনো সীমা নেই। এটি 32 MiB রিকোয়েস্ট বডির গণনায় পড়ে। | ইমেজ বা ফাইল নেয় এমন প্রতিটি এন্ডপয়েন্ট | পুরো রিকোয়েস্টের জন্য স্ট্যাটাস 413। |
POST /v1/tokenize-এর text | 4,000,000 বাইট | /v1/tokenize | স্ট্যাটাস 413, type invalid_request_error, বার্তা text too long। |
POST /v1/tokenize-এর messages এবং POST /v1/messages/count_tokens-এর বডি | 32 MiB রিকোয়েস্ট বডি | গণনার দুটি এন্ডপয়েন্টই | স্ট্যাটাস 413। |
| কনটেক্সট উইন্ডো | মডেল অনুযায়ী: GET /v1/models-এর context_window | প্রতিটি মডেল | দীর্ঘতর কথোপকথনের কী হবে তা মডেলের ওপর নির্ভর করে। মডেল ও মূল্য |
ওয়েব সার্চ (web_search: true) | প্ল্যান ও দিন অনুযায়ী: Free 3, Plus 30, Standard 50, Pro 60। যে রিকোয়েস্টের সার্চে ফলাফল পাওয়া গেছে তার জন্য একটি সার্চ গোনা হয়। | যেসব রিকোয়েস্ট web_search: true দেয় | কিছু বাকি না থাকলে রিকোয়েস্টের উত্তর সার্চ ছাড়া দেওয়া হয়। কোনো এরর নেই। ওয়েব সার্চ |
এরর
এই পেজের উত্তরগুলো। /v1/messages-এ একই error অবজেক্ট {"type": "error", "error": {…}} হিসেবে মোড়ানো থাকে।
| স্ট্যাটাস | টাইপ | বার্তা | কখন, এবং কী করবেন |
|---|---|---|---|
429 | rate_limit_error | Quota exceeded. Upgrade your plan at shannon-ai.com/plan | রিকোয়েস্টের সংরক্ষণ আপনার ব্যালেন্সে ধরে না। 00:00 UTC পর্যন্ত অপেক্ষা করুন, ক্রেডিট টপ-আপ করুন, প্ল্যান বদলান, অথবা ছোট max_tokens পাঠান। |
429 | rate_limit_error | Too many requests. Retry in <N>s. | বর্তমান মিনিটে 120টির বেশি রিকোয়েস্ট। N সেকেন্ড অপেক্ষা করে আবার পাঠান। |
429 | rate_limit_error | Shannon Coder call quota reached. Upgrade your plan at shannon-ai.com/plan | বর্তমান 4 ঘণ্টার উইন্ডোর Shannon Coder কল শেষ হয়ে গেছে। |
429 | rate_limit_error | Shannon routes are temporarily busy. Please retry. | মডেল এই মুহূর্তে রিকোয়েস্ট নিতে পারছে না। একটু থেমে আবার পাঠান। |
503 | api_error | Could not verify your quota right now. Please retry. | আপনার ব্যালেন্স পড়া যায়নি। কিছু চার্জ হয়নি; রিকোয়েস্ট আবার পাঠান। Shannon মডেলসহ /v1/responses-এ স্ট্যাটাস 500। |
413 | invalid_request_error | রিকোয়েস্ট বডি 32 MiB-এর চেয়ে বড়। OpenAI-ফরম্যাট এন্ডপয়েন্টে error অবজেক্টে code: "request_too_large" থাকে। | |
413 | invalid_request_error | text too long | POST /v1/tokenize-এর text 4,000,000 বাইটের চেয়ে দীর্ঘ। |