السعر لكل مليون رمز: المقارنة الكاملة للذكاء الاصطناعي للبرمجة (الاشتراكات، وواجهات API، والمجمّعات، والتشغيل محليًا)
كم ينبغي لمطوّر أن ينفق فعلاً على الذكاء الاصطناعي كل شهر؟
قست استهلاكي الفعلي خلال أربعة عشر يوماً. ثم طبّقت جداول الأسعار الرسمية في السوق لحساب السعر لكل مليون رمز لكل عرض. هذه المرة، أبدأ بالإجابة. كانت النسخة الأولى من هذا المقال تعرض كل الأرقام، لكنها لم تجب بوضوح عن السؤال.
إليك الإجابة إذن. الجداول تأتي بعد ذلك.
ما ينبغي أن تختار، فوراً
| حالتك | ما تختاره | شهرياً | باليورو شامل الضرائب |
|---|---|---|---|
| تتعلّم أو تعبث مساءً | GLM-4.7 Flash عبر API، مجاناً، وOllama على جهازك | 0 $ | 0 € إذا كانت لديك بطاقة الرسوميات أصلاً |
| تكتب الشيفرة لكسب عيشك | Claude Pro للحكم، وGLM Coding Lite للحجم، ورصيد صغير من DeepSeek API للتجاوزات | 58 $ | نحو 65 € |
| الذكاء الاصطناعي هو محطة عملك من الصباح إلى المساء | Claude Max 20x، إضافة إلى GLM Coding Pro كمحرّك ثان | 272 $ | نحو 303 € |
| أنتم خمسة | Copilot Business بسعر 19 $ لكل مقعد، وGLM Coding Pro مشترك، ورصيد من الاعتمادات للاختبارات | 190 $ | نحو 212 €، قابلة للاسترداد إذا كانت لديك شركة |
وإذا كنت لا تريد التفكير في الأمر فعلاً، فاختر Claude Pro بسعر 20 $. لن تكون صفقة سيئة. ستدفع ببساطة أكثر بقليل في اليوم الذي تبلغ فيه الحد الأقصى.
ها هو ذا. يمكنك إغلاق علامة التبويب. يشرح الجزء التالي كيف توصلت إلى هذه الإجابة. وهو يوضح خصوصاً لماذا لا تكاد تكون للسعر المعروض من قبل أحد المورّدين أي علاقة بما ستدفعه فعلاً.
السعر المعروض يكذب، ويمكنني أن أخبرك بمقدار كذبه
لم يعد الاشتراك يبيع الرموز مباشرة. Claude Pro وChatGPT Plus وGLM Coding Plan تبيع نوافذ مدتها خمس ساعات وسقوفاً أسبوعية. ولحساب سعر كل مليون رمز، يجب إذن معرفة استهلاكك الفعلي. ذهبت لقياس استهلاكي.
حلّلت سجلات جلسات Claude Code في ~/.claude/projects : 724 ملفاً، من 28 يوليو إلى 11 أغسطس 2026. يجمع برنامجي الرموز التي تعلنها واجهة API في كل إجابة، ثم يطبّق جدول أسعار Anthropic.
| ما قسته | النتيجة |
|---|---|
| الفترة | 14 يومًا، من 28/07 إلى 11/08/2026، 724 ملف جلسة |
| الرموز المستهلكة | 5,85 مليارات |
| ما كانت واجهة API ستتقاضاه مني | 4 867 $، أي نحو 10 400 $ شهريًا |
| متوسط التكلفة لكل مليون | 0,84 $، وليس 5 $ أو 25 $ |
| قراءة ذاكرة التخزين المؤقت | 95,81 % من الحجم |
| كتابة ذاكرة التخزين المؤقت | 3,60 % من الحجم |
| المخرجات، الشيفرة المكتوبة فعليًا | 0,55 % من الحجم |
| مدخلات لم تُرَ من قبل | 0,04 % من الحجم |
تكلّف Claude Opus 5 خمسة دولارات لكل مليون رمز في المدخلات و25 في المخرجات. ومع ذلك، تنخفض تكلفتي الفعلية إلى 0,84 دولار. لماذا؟ يقضي وكيل البرمجة وقته في إعادة قراءة المستودع نفسه. تأتي عمليات إعادة القراءة هذه من ذاكرة التخزين المؤقت، وهي نسخة من السياق يحتفظ بها المزوّد ويحاسب عليها بسعر أقل بعشر مرات. وهي تمثّل كل الحجم تقريبًا. أما الشيفرة المُنتَجة فعليًا فلا تمثّل سوى نصف بالمئة.
المقارنات التي تفترض 70 % من المدخلات و30 % من المخرجات تصل إلى 11 دولارًا لكل مليون وفق جدول أسعار Opus 5. أنا أقيس 0,84 دولار. نتيجتهم أعلى بثلاثة عشر مرة مما ينبغي.
لكن نتيجة أخرى جعلتني أرفع رأسي. لم ألاحظها في النسخة الأولى.
ثلاثة فاصلة ستة بالمئة من الحجم، وسبعة وعشرون بالمئة من الفاتورة. كتابة ذاكرة التخزين المؤقت هي فشار السينما.
تمثّل قراءة ذاكرة التخزين المؤقت 95,81 % من الحجم، لكنها لا تمثّل سوى 57 % من الفاتورة. ولا تزن كتابة ذاكرة التخزين المؤقت سوى 3,6 % من الحجم، لكنها تمثّل 27 % من السعر. ربع الفاتورة مقابل نحو جزء واحد من ثلاثين من حركة المرور. هنا يذهب مالك. ولا أحد يتحدث عن ذلك، لأن هذه التكلفة لا تظهر بوضوح في أي صفحة أسعار.
لذلك أطبّق قاعدة بسيطة في ما يلي كله: أعيد حساب كل سطر وفق أسعاره الأربعة، المدخلات، وقراءة ذاكرة التخزين المؤقت، وكتابة ذاكرة التخزين المؤقت، والمخرجات. لا توجد صيغة عالمية. النموذج الذي لا يستخدم ذاكرة التخزين المؤقت يحاسب على كل إعادة قراءة بالسعر الكامل. الفرق قاسٍ.
effectif = cache_lecture x 0,9581
+ cache_ecriture x 0,0360
+ sortie x 0,0055
+ entree x 0,0004تحفّظان. استخدامي متطرف: أنسّق عمل عدة وكلاء فرعيين بالتوازي، وهو ما يفسّر عشرين ساعة جلسة تراكمية في اليوم خلال القياس. ولم أختبر أيضًا العروض الأربعين في هذا المقال. أستخدم Claude Code كل يوم وقد عبثت قليلًا مع Ollama. أما في ما عدا ذلك، فأعتمد على جداول الأسعار الرسمية.
الجدول، دفعة واحدة
هذا هو السوق بأكمله في جدول واحد، من الأرخص إلى الأغلى. مؤشر القدرة من وضعي. بنيته انطلاقًا من نتائج SWE-bench Verified وSWE-bench Pro المسجلة على BenchLM في 10 أغسطس، ثم استكملته بانطباعي عندما لم تكن هناك أي نتيجة متاحة للعامة. تشير النجمة إلى التقديرات. الأسعار مأخوذة مباشرة من المصادر الرسمية.
| النموذج | النتيجة | الإدخال | التخزين المؤقت | الإخراج | التكلفة الفعلية | أين تجده |
|---|---|---|---|---|---|---|
| GLM-4.7 Flash | 48* | مجاني | مجاني | مجاني | 0 $ | API ومحلي |
| DeepSeek V4 Flash | 60* | 0,14 $ | 0,0028 $ | 0,28 $ | 0,009 $ | API |
| DeepSeek V4 Pro | 74* | 0,435 $ | 0,0036 $ | 0,87 $ | 0,024 $ | API، أوزان مفتوحة |
| GPT-5.6 Luna | 58* | 0,20 $ | 0,02 $ | 1,20 $ | 0,033 $ | API واشتراك |
| MiniMax M2 | 64* | 0,30 $ | 0,03 $ | 1,20 $ | 0,049 $ | API |
| Qwen3 Coder Next | 66* | 0,30 $ | 0,03 $ | 1,50 $ | 0,051 $ | API، أوزان مفتوحة |
| Qwen3.7 Plus | 68* | 0,40 $ | 0,04 $ | 1,60 $ | 0,065 $ | API |
| GLM-4.7 | 70* | 0,60 $ | 0,06 $ | 2,20 $ | 0,091 $ | API، أوزان مفتوحة |
| Claude Haiku 4.5 | 62* | 1,00 $ | 0,10 $ | 5,00 $ | 0,169 $ | API واشتراك |
| GLM-5.2 | 76* | 1,40 $ | 0,14 $ | 4,40 $ | 0,209 $ | API واشتراك |
| Kimi K2.7 Code | 72* | 0,95 $ | 0,19 $ | 4,00 $ | 0,239 $ | API، أوزان مفتوحة |
| GPT-5.3 Codex | 82* | 1,75 $ | 0,175 $ | 14,00 $ | 0,308 $ | API واشتراك |
| GPT-5.6 Terra | 84* | 2,00 $ | 0,20 $ | 12,00 $ | 0,330 $ | API واشتراك |
| Gemini 3.1 Pro | 80* | 2,00 $ | 0,20 $ | 12,00 $ | 0,330 $ | API واشتراك |
| Claude Sonnet 5 | 86 | 2,00 $ | 0,20 $ | 10,00 $ | 0,337 $ | API واشتراك |
| Grok 4.5 | 75* | 2,00 $ | 0,30 $ | 6,00 $ | 0,393 $ | API واشتراك |
| GPT-5.4 | 78* | 2,50 $ | 0,25 $ | 15,00 $ | 0,413 $ | API واشتراك |
| Kimi K3 | 78* | 3,00 $ | 0,30 $ | 15,00 $ | 0,479 $ | API، أوزان مفتوحة |
| GPT-5.6 Sol | 88* | 5,00 $ | 0,50 $ | 30,00 $ | 0,826 $ | API واشتراك |
| Claude Opus 5 | 100 | 5,00 $ | 0,50 $ | 25,00 $ | 0,844 $ | API واشتراك |
| Claude Fable 5 | 98 | 10,00 $ | 1,00 $ | 50,00 $ | 1,687 $ | API واشتراك |
| GPT-5.5 Pro | 85* | 30,00 $ | لا شيء | 180,00 $ | 30,825 $ | API |
الأسعار مبيّنة بالدولار لكل مليون رمز. وقد جُمعت في 12 أغسطس 2026 من الصفحات الرسمية. ويقابل عمود «Cache» تعرفة قراءة الكاش.
فرق تسعين ضعفًا في السعر. فرق ضعفين في القدرة. ابحث عن الخطأ.
هناك أربع ملاحظات تقفز إلى العين. الأخيرة تصحح خطأ اكتشفه قارئ شديد الانتباه: أنا شخصيًا، بعد يومين.
أولًا، تعرفة قراءة الكاش تحسم كل شيء تقريبًا. تفرض DeepSeek مبلغ 0.0028 دولار على هذه القراءة، أي 2% من سعر الإدخال. يطبّق معظم المورّدين الآخرين نسبة 10%. بالنسبة إلى وكيل يعيد قراءة سياقه في حلقة، يكون لهذا الفرق وزن أكبر من سعر الإدخال المعلن. وهكذا ينخفض سعر DeepSeek V4 Flash إلى أقل من سنت لكل مليون، أي أرخص بثلاثة وتسعين مرة من Opus 5.
ثم إن مورّدين اثنين يفرضان على الكاش سعرًا أعلى من المتوسط، ويمرّ ذلك دون أن يلاحظه أحد تقريبًا. تفرض Kimi K2.7 على القراءة سعرًا يعادل 0.20 من سعر الإدخال. وتفرض Grok 4.5 سعرًا يعادل 0.15، مقابل 0.10 في كل مكان تقريبًا. وهكذا ترتفع تكلفتهما الفعلية بنسبة 50% و25%.
ثالثًا، تضيف Gemini فخًا لم أره في أي مكان آخر. إضافة إلى القراءة، تفرض Google رسوم تخزين الكاش بقيمة 4.50 دولارات لكل مليون ولكل ساعة. إذا تركت الكاش مفتوحًا أثناء الغداء، فسيواصل تكليفك بالمال من دون إعادة قراءة أي رمز. بفت. الآن تعرف ذلك.
وأخيرًا، GPT-5.5 Pro. لا تملك هذه النمذجة أي تعرفة للكاش. في النسخة الأولى، كنت قد طبّقت عليها رغم ذلك تخفيض الكاش. خطأ غبي بحجم عواقب هائل. من دون كاش، تُفرض رسوم إعادة القراءة البالغة 95.81% بالسعر الكامل: 30.83 دولارًا للمليون، أي سبعة وثلاثون ضعف سعر Opus 5، وليس ستة أضعاف كما كتبت. أداؤه أسوأ في البرمجة ويكلّف سبعة وثلاثين ضعفًا. بالنسبة إلى وكيل، هذا ليس غاليًا. هذا إقصائي.
هناك عتبتان تستحقان انتباهك أيضًا. تضاعف Gemini وGrok أسعارهما بعد 200,000 رمز من السياق. لدى Grok، ينطبق هذا التضاعف على الطلب بأكمله، وليس فقط على الرموز التي تتجاوز العتبة. تطبّق GPT-5.6 الفخ نفسه عند 272,000 رمز. عندما يتجاوز السياق الحد، لا ترتفع الفاتورة تدريجيًا. بل تتضاعف دفعة واحدة.
الاشتراكات، وما تخفيه فعلًا
هنا نغادر جداول الأسعار العامة لندخل في الضبابية. يبيّن الجدول شيئين: سعر العرض وما تنشره الجهة المطوّرة فعلًا عن سقفها. والعمود الثاني يقول الكثير أصلًا.
| العرض | شهريًا | ما يقوله السقف فعلًا |
|---|---|---|
| Claude Pro | 20 $، أو 17 $ سنويًا | نوافذ مدتها 5 ساعات، سقف أسبوعي، لا رقم منشور |
| Claude Max 5x | 100 $ | خمسة أضعاف Pro، من دون رقم دائمًا |
| Claude Max 20x | 200 $ | عشرون ضعف Pro. عندي، القياس الذي حصلت عليه: 12,5 مليار token شهريًا، أي 0,016 $ للمليون |
| GLM Coding Lite | 18 $ | 10 000 رصيدًا في الأسبوع، رقم منشور. نحو 43 إلى 87 مليون token وفق معدل التخزين المؤقت لديك |
| GLM Coding Pro | 72 $ | 60 000 رصيد في الأسبوع، رقم منشور |
| GLM Coding Max | 160 $ | 140 000 رصيد في الأسبوع، رقم منشور |
| ChatGPT Plus | 20 $ | من 15 إلى 90 رسالة في نافذة مدتها 5 ساعات على Sol، مع جدول بالرصيد لكل مليون منشور الآن |
| ChatGPT Pro | 100 $ مقابل 5x، 200 $ مقابل 20x | مضاعفات Plus. ليس غير محدود، وهذا ما توضحه الوثائق |
| ChatGPT Business | 25 $ للمقعد، 20 $ سنويًا | 3 000 طلب في الأسبوع على نموذج الاستدلال |
| Google AI Pro | 21,99 € | 1 500 طلب في اليوم على Code Assist |
| Google AI Ultra | 99,99 € | 2 000 طلب في اليوم |
| SuperGrok | 30 $ | حصة أسبوعية معبّر عنها بنسبة مئوية. لا رقم مطلق |
| GitHub Copilot Pro | 10 $ | 10 $ من الرصيد، يُستهلك بسعر API |
| GitHub Copilot Pro+ | 39 $ | 39 $ من الرصيد |
| GitHub Copilot Business | 19 $ للمقعد | 19 $ من الرصيد لكل مقعد |
| Cursor Pro | 20 $ | 20 $ من الاستخدام مشمولة، بسعر API |
| Cursor Ultra | 200 $ | 400 $ من الاستخدام مشمولة |
| Zed Pro | 10 $ | 5 $ من الرصيد، ثم سعر API مع زيادة 10 % |
| Le Chat Pro | 14,99 $ | 150 إجابة سريعة في اليوم |
ثلاث ملاحظات:
انتقل GitHub Copilot إلى الفوترة حسب الاستخدام في 1 يونيو 2026. تدفع 10 دولارات وتحصل على 10 دولارات من الرصيد. واحد مقابل واحد. لم يعد هذا إذن اشتراكًا بالمعنى الحقيقي، بل صار واجهة API محاطة بمحرر. الأمر نفسه لدى Cursor و Zed، اللذين يعيدان بيع الرموز لك بسعر المحرر مع رصيد شهري. كلمة «اشتراك» لم تعد تعني الكثير بالنسبة إلى نصف هذا الجدول.
يبقى GLM الوحيد الذي ينشر سقفه بوحدات قابلة للتحقق. تغيّر نظامه في 30 يوليو: لم نعد نعدّ بـ «المطالبات» بل بالأرصدة، مع 10,000 رصيد أسبوعيًا لخطة Lite. معادلتي بالرموز تفترض معدل تخزين مؤقت يبلغ 90.9%. هذا الرقم وارد في الوثائق، وليس من عندي. يختبئ المزوّدون الآخرون خلف نوافذ مدتها خمس ساعات يستحيل التحقق منها. Claude هو الأسوأ في هذه النقطة، مع أنه تحديدًا الذي أستخدمه. يزعجني أن أكتب ذلك، لكنه صحيح.
يبقى رقمي الشخصي هو الأكثر دلالة. خلال أربعة عشر يومًا، استهلكت ما يعادل 4,867 دولارًا من واجهة API. مقارنة بسعر Max 20x خلال الفترة نفسها، يعطينا ذلك نسبة 52 إلى 1. لا يمكن لأي اشتراك أن يكون مربحًا مع هذا النمط من الاستخدام. إما أن Anthropic تدعم الاستخدام ماليًا بشكل هائل، أو أن الحدود تمنع الجميع تقريبًا من بلوغ هذا المستوى. على الأرجح كلا الأمرين. لن أشتكي من ذلك بصوت عالٍ جدًا.
الطبقات الأربع، ومتى تنهار
أربع طبقات. الخيار الوحيد الذي عليك اتخاذه هو أن تعرف في أي طبقة تعيش.
أنت تتعلم، 0 دولار. يتولى GLM-4.7 Flash عبر واجهة API الجزء الأكبر من العمل. ويتكفل Ollama بالإكمال التلقائي والعمل دون اتصال. تنهار هذه الطبقة بمجرد أن تتطلب مهمة ما تفكيرًا حقيقيًا: يدور النموذج في حلقة مفرغة، وعليك أن تعرف كيف تستعيد زمام الأمور. ولا تكون هذه الطبقة حقيقية إلا إذا كنت تملك بطاقة رسومية أصلًا. وإلا فاحسب 1,500 يورو لبطاقة 4090 مستعملة، أي 42 يورو شهريًا مع استهلاك موزع على ثلاث سنوات. المجاني له فاتورة.
أنت تبرمج لتعيش، 58 دولارًا. يضيف Claude Pro بسعر 20 دولارًا الحكم السليم. ويوفر GLM Coding Lite بسعر 18 دولارًا الحجم. ويستوعب نحو 20 دولارًا من واجهة DeepSeek API الاستخدام الزائد. تجعل النموذج الرخيص يضع الأساس، ثم تطلب من الأفضل أن يصقله. مقابل 20 دولارًا، يوفر DeepSeek V4 Flash أكثر من ملياري رمز بالسعر الفعلي. نعم، مليارا رمز. تنهار هذه الطبقة إذا قضيت كل أيامك داخلها. عندها يبلغ Claude Pro حده قبل الباقي. تلك هي الإشارة للانتقال إلى Max.
الذكاء الاصطناعي مهنتك وما زلت تبرمج مساءً، 272 دولارًا. يعمل Claude Max 20x كمحرك أساسي. ويعمل GLM Coding Pro بالتوازي كمحرك ثانٍ. هذه تقريبًا هي طبقـتي. الحساب بسيط: كان استهلاكي سيكلف 10,400 دولار شهريًا مع واجهة API. حتى عند قسمته على خمسة لتمثيل استخدام أكثر عقلانية، يبقى الاشتراك أرخص بعشر مرات. ماذا نخسر في المقابل؟ 272 دولارًا. في هذا المستوى، أنت تدفع خصوصًا كي تتوقف عن مراقبة العداد. بصراحة، السعر يستحق ذلك.
الذكاء الاصطناعي مهنتك لكنك لم تعد تبرمج مساءً وفي عطلة نهاية الأسبوع: قد يكون اشتراك Claude Code Max x20 بسعر 200 دولار، إذا حُسّن جيدًا (من دون ملف Claude.md ضخم، وRoslyn في mcp إذا كنت تبرمج بـ .Net (فهذا يتجنب استخدام 'grep' في كل شيء)) كافيًا أيضًا، والأمر متروك لك ولحجم استهلاكك
أنتم خمسة، 190 دولارًا. تبلغ تكلفة Copilot Business 19 دولارًا لكل مقعد، ويغطي الإكمال التلقائي وكذلك التكامل مع المستودعات. ويتولى GLM Coding Pro مشترك بسعر 72 دولارًا المهام الكبيرة. ويتيح نحو عشرين دولارًا من أرصدة OpenRouter اختبار نماذج أخرى من دون فتح خمسة حسابات. العيب هو أن لا أحد يملك وصولًا دائمًا إلى نموذج متقدم. إذا كان الفريق بأكمله يستخدم وكلاء ثقيلة طوال اليوم، فيجب الانتقال إلى مقاعد Claude Team. عندها تتغير الميزانية بمقدار كبير.
المحلي والمجمّعات، مساران جانبيان ينبغي معرفتهما
التشغيل المحلي ليس مجانيًا. وهذه على الأرجح أكثر كذبة منتشرة حول الموضوع. الكهرباء تكلف قليلًا: مع 350 واط أثناء الحمل وبالتعرفة البلجيكية، نصل إلى نحو 0.55 يورو لكل مليون رمز منتج. التكلفة الحقيقية هي البطاقة الرسومية. يبلغ سعر بطاقة 4090 مستعملة نحو 1,500 يورو، أي 42 يورو شهريًا على مدى ثلاث سنوات، حتى قبل كتابة سطر واحد. وتشغّل بطاقة 3090 مستعملة بسعر 700 يورو النماذج نفسها، بسرعة أقل بنحو 20%، لكنها تقسم تكلفة الاستهلاك إلى النصف.
| النموذج المحلي | المؤشر | VRAM | معدل النقل على RTX 4090 | ما أراه فيه |
|---|---|---|---|---|
| Qwen3-Coder 30B | 55* | 19 جيجابايت | 40 إلى 60 tok/s | الخيار الأفضل. بنيته ذات الخبراء لا تفعّل سوى 3,3 مليارات من المعلمات، ما يجعله سريعًا رغم حجمه. سياقه البالغ 256K ضخم بالنسبة إلى نموذج محلي. تحتاج إلى بطاقة بسعة 24 جيجابايت |
| Qwen3.6 27B | 50* | 17 جيجابايت | حوالي 30 tok/s | نموذج كثيف، لذلك تعمل جميع المعلمات عند كل token. إنه أبطأ تقريبًا بمرتين مقابل نتيجة مماثلة |
| GLM-4.7 Flash | 48* | 19 جيجابايت | لم أقسه عندي | سياق يبلغ 198K والحجم نفسه. إنه حل موثوق، ومتاح أيضًا عبر API مجاني إذا كنت تفضّل الاحتفاظ ببطاقتك لشيء آخر |
| Kimi وDeepSeek الكاملان | 70 فما فوق* | 200 جيجابايت فما فوق | بطيء جدًا | رائعان على الورق، لكنهما غير عمليين على جهاز مطوّر. تحتاج إلى محطة مزودة بعدة بطاقات أو جهاز Mac بسعة 128 جيجابايت، وتبقى النتيجة بطيئة. اتركهما للفضوليين |
الفارق في القدرة حقيقي تمامًا. يصل نموذج محلي يتسع في 19 جيجابايت من ذاكرة الفيديو إلى حوالي 55 على مؤشري، مقابل 100 لـ Opus 5. هذه ليست مجرد مسألة صقل. إنه الفارق بين مساعد يُكمل سطرًا ووكيل يعيد هيكلة وحدة بمفرده. يفيد النموذج المحلي خصوصًا في الإكمال التلقائي والمهام الميكانيكية والشفرة التي يجب ألا تغادر أي جهاز. بالنسبة إلى الباقي، تكلف API رخيصة أقل من استهلاك قيمة البطاقة.
لننتقل إلى المجمّعات. إنها جهات وسيطة توفر حسابًا وفاتورة واحدة للوصول إلى عشرات النماذج.
OpenRouter لا يضيف أي هامش على الاستدلال. توضح وثائقه ذلك بجلاء. يحقق الموقع أرباحه من إعادة شحن الرصيد، مع رسوم قدرها 5,5 % عند الدفع بالبطاقة المصرفية. مفاجأة، قد يكون حتى أرخص من الجهة المطوّرة، لأنه يوجّه الطلب إلى أرخص مزود في شبكته. تبلغ تكلفة Kimi K2.7 هناك 0,68 دولار، مقابل 0,95 لدى Moonshot. كنت قد كتبت «بالنسبة إلى الكميات الكبيرة، اذهب مباشرة إلى الجهة المطوّرة». لذلك يجب التحقق في كل حالة على حدة، لأن هذا لم يعد صحيحًا دائمًا.
Together AI يعرض هو أيضًا أسعارًا أقل من أسعار بعض الجهات المطوّرة. تعلن Hugging Face عن هامش صفري وتمنح حسابات PRO رصيدًا قدره 2 دولار شهريًا. تنشر Fireworks جدول أسعار يستند إلى حجم النموذج، من 0,10 إلى 1,20 دولار لكل مليون. لدى Cerebras، تظهر باقتا Code، بسعر 50 دولارًا مقابل 24 مليون token يوميًا و200 دولار مقابل 120 مليونًا، بحالة «sold out». هكذا تنتهي الأمور عندما تبيع السرعة.
ما سيتغير بحلول الخريف
لنبدأ بخبر جيد، يلغي جملة من نسختي الأولى. كنت قد كتبت أن سعر طرح Claude Sonnet 5 سينتهي في 31 أغسطس، قبل أن يرتفع إلى 3 و15 دولارًا، وأنني سأحدّث الجدول في سبتمبر. أُلغيَت الزيادة. جعلت Anthropic أسعار 2 و10 دولارات دائمة. لذلك لا توجد أي تحديثات مقررة. يبقى Sonnet 5 عند 0.337 دولار لكل مليون فعلي، ما يمنحه أفضل نسبة بين القدرة والسعر في الجدول.
أما DeepSeek، فيعلن في وثائقه عن زيادة كبيرة قادمة. لا تبنِ ميزانيتك السنوية على سعر قدره 0.009 دولار.
اختفى SuperGrok Heavy أيضًا من الصفحات الرسمية لـ xAI. لم يبقَ سوى SuperGrok بسعر 30 دولارًا وSuperGrok Plus بسعر 100 دولار. أما مبالغ 300 دولار المتداولة فتأتي من مدونات، لا من صفحة للناشر أبدًا.
ما أستخلصه
السعر المعروض لنموذج لا يخبرك تقريبًا بأي شيء عن فاتورتك الفعلية. سعر قراءة ذاكرة التخزين المؤقت مهم جدًا، لأن هذه القراءة تمثل 96% مما يستهلكه وكيل. وكتابة ذاكرة التخزين المؤقت مهمة أيضًا، لأنها تنتج ربع الفاتورة مقابل نحو واحد من ثلاثين من حركة المرور. قد ينتهي الأمر بنموذجين معروضين بالسعر نفسه إلى نسبة واحد إلى خمسة. أما النموذج الذي لا يملك ذاكرة تخزين مؤقت، فيُستبعد تلقائيًا، مهما كانت نتيجته.
يصل فرق السعر بين أعلى الجدول وأسفله إلى نحو تسعين ضعفًا، مقابل ضعفَين فقط للقدرة. هذا لا يجعل النماذج الراقية عديمة الفائدة. إذا فشل نموذج صغير في مهمة ما، فلن يفيدك سعره المنخفض في شيء. النتيجة وحدها هي المهمة. أما إرسال كل مهمة إلى النموذج الأغلى فيبقى هدرًا خالصًا. لذلك تجمع حزمة جيدة بين نموذجين.
إذا لم يكن عليك أن تتذكر سوى رقم واحد، فتذكر هذا الرقم: مقابل 40 إلى 60 دولارًا شهريًا، أي نحو 45 إلى 65 يورو شامل الضرائب، يستطيع مطور مستقل اليوم الوصول إلى قدرة كانت تكلف عدة آلاف من الدولارات قبل عام. لم يعد السؤال «هل يستحق الأمر». بل «أي تركيبة». الإجابة في أعلى الصفحة.
كُتب المقال في 12 أغسطس 2026، وقد تتغير الأسعار في هذه الأثناء.



انضموا إلى المحادثة
يجب أن يكون لديك حساب للتعليق على هذا المقال. إنشاء الحساب مجاني ويستغرق أقل من دقيقة.
لا توجد تعليقات في الوقت الحالي.