الرمز (token) يعادل تقريبًا ثلاثة أرباع كلمة إنجليزية، كما أوضحت صفحة تسعير OpenAI نفسها عام 2022، مباشرة بعد الإشارة إلى أن جملة من 35 رمزًا تكلف جزءًا من السنت. هذا التوصيف بالكاد يصمد أمام واقع 2026: فأصغر النماذج تكلف اليوم جزءًا من جزء من السنت لكل رمز، وأكبرها يكلف خمسين دولارًا لكل مليون رمز إخراج، وقد خفّضت ثلاث جهات — OpenAI وAnthropic وDeepSeek — ورفعت وقسّمت وأعادت تقسيم أسعارها عدة مرات. كل رقم أدناه مأخوذ من صفحة جلبناها فعليًا: إما صفحة التسعير الحالية للمزوّد، أو لقطة من أرشيف الإنترنت (Internet Archive) لتلك الصفحة نفسها بالتاريخ الموضح. وحيثما نحسب نسبة، يُذكر الرقمان اللذان بُنيت عليهما في الفقرة نفسها.
OpenAI، من 2022 إلى 2026
في نوفمبر 2022، سردت صفحة تسعير OpenAI أربعة نماذج أساسية، هي Ada وBabbage وCurie وDavinci، وكانت جميعها مُسعَّرة بالسعر نفسه لكل رمز بغض النظر عن كونه رمز إدخال أو إخراج — لم يكن هناك تقسيم إدخال/إخراج بعد. كان Davinci، الأقدر بين الأربعة، يكلف 0.02 دولار لكل 1,000 رمز. تؤكد صفحة إيقاف النماذج الحالية من OpenAI بشكل مستقل هذا الرقم بالضبط، 20.00 دولارًا لكل مليون رمز، كسعر كان يُفوتَر به text-davinci-003 — النموذج المحدد المبني على تلك الفئة — حتى إيقافه عام 2024. بعد أربعة أشهر، أُطلق GPT-4 بسعر 0.03 دولار لكل 1,000 رمز إدخال و0.06 دولار لكل 1,000 رمز إخراج لنسخته بسياق 8 آلاف رمز، وتضاعف إلى 0.06 و0.12 دولار لنسخة 32 ألف رمز — وهي المرة الأولى التي يفرض فيها تسعير OpenAI العلني على رموز الإخراج أكثر من رموز الإدخال. وأُطلق gpt-3.5-turbo في الشهر نفسه بسعر ثابت قدره 0.002 دولار لكل 1,000 رمز، مجددًا دون تقسيم إدخال/إخراج.
| النموذج | الإدخال $/مليون | الإخراج $/مليون | مُسعَّر بتاريخ | المصدر |
|---|---|---|---|---|
| text-davinci-003 | $20.00 | $20.00 | نوفمبر 2022 | صفحة تسعير مؤرشفة |
| gpt-3.5-turbo (عند الإطلاق) | $2.00 | $2.00 | مارس 2023 | صفحة تسعير مؤرشفة |
| GPT-4، سياق 8K (عند الإطلاق) | $30.00 | $60.00 | مارس 2023 | صفحة تسعير مؤرشفة |
| gpt-4o-2024-05-13 (عند الإطلاق) | $5.00 | $15.00 | مايو 2024 | توثيق تسعير OpenAI |
| o1 (استدلال) | $15.00 | $60.00 | القائمة الحالية | توثيق تسعير OpenAI |
| gpt-4o (السعر الحالي) | $2.50 | $10.00 | حالي | توثيق تسعير OpenAI |
| gpt-6-luna (الأرخص حاليًا) | $0.10 | $0.50 | حالي | توثيق تسعير OpenAI |
| gpt-6-astra (النموذج الرائد الحالي) | $10.00 | $50.00 | حالي | توثيق تسعير OpenAI |
مقارنتان، مبنيتان فقط من الصفوف أعلاه: سعر إدخال text-davinci-003 البالغ 20.00 دولارًا مقابل سعر gpt-6-luna الحالي البالغ 0.10 دولار هو انخفاض بمقدار 200 ضعف على مدى نحو أربع سنوات، بالنسبة لأرخص فئة متاحة من OpenAI في كل نقطة زمنية. لكن سعر إدخال GPT-4 الأصلي البالغ 30.00 دولارًا مقابل سعر gpt-6-astra الحالي البالغ 10.00 دولارات هو انخفاض بمقدار 3 أضعاف فقط لمقارنة بين نموذجين رائدين — فقد انخفضت الفئة الرخيصة بسرعة أكبر بكثير من الفئة المكلفة. وأُعيد تسعير gpt-4o نفسه نحو الانخفاض بعد إطلاقه، من 5.00/15.00 دولارًا في مايو 2024 إلى 2.50/10.00 دولارًا اليوم، وهي حالة مباشرة لنفس النموذج يصبح أرخص دون أن تتغير قدراته على الإطلاق.
Anthropic، من 2023 إلى 2026
أقدم ورقة تسعير للمطورين من Anthropic تمكّنا من استعادتها، ملف PDF مؤرشف من يوليو 2023، سعّرت Claude 2 — الذي أُطلق في الشهر نفسه — بـ 11.02 دولارًا لكل مليون رمز إدخال و32.68 دولارًا لكل مليون رمز إخراج، وأشارت إلى أن Claude 1 ظل متاحًا بالسعر نفسه تمامًا. وكان Claude Instant، الفئة الرخيصة حينها، بسعر 1.63 دولار للإدخال و5.51 دولار للإخراج. بحلول أوائل 2024، قبل إطلاق Claude 3، تُظهر لقطة مؤرشفة أن Claude 2.0 وClaude 2.1 خُفِّضا إلى 8.00/24.00 دولارًا وInstant خُفِّض إلى 0.80/2.40 دولارًا — تخفيضات متواضعة على التشكيلة القائمة. أعاد Claude 3، الذي أُطلق في مارس 2024، ضبط الحد الأدنى للنطاق بالكامل: جاء Haiku بسعر 0.25/1.25 دولارًا، أقل بكثير من أي شيء قدّمته Anthropic من قبل، بينما أُطلق Sonnet وOpus بسعري 3.00/15.00 دولارًا و15.00/75.00 دولارًا. وأُطلق Claude 3.5 Sonnet، بعد ثلاثة أشهر، بالسعر نفسه تمامًا 3.00/15.00 دولارًا مثل Claude 3 Sonnet — حالة بقي فيها السعر ثابتًا بينما تحسّن النموذج نفسه.
| النموذج | الإدخال $/مليون | الإخراج $/مليون | مُسعَّر بتاريخ | المصدر |
|---|---|---|---|---|
| Claude 1 / Claude 2 (السعر نفسه) | $11.02 | $32.68 | يوليو 2023 | ملف تسعير PDF مؤرشف |
| Claude Instant | $1.63 | $5.51 | يوليو 2023 | ملف تسعير PDF مؤرشف |
| Claude 2.0 / 2.1 (بعد تخفيض السعر) | $8.00 | $24.00 | فبراير 2024 | ملف تسعير PDF مؤرشف |
| Claude 3 Haiku (عند الإطلاق) | $0.25 | $1.25 | مارس 2024 | صفحة API مؤرشفة |
| Claude 3 Sonnet (عند الإطلاق) | $3.00 | $15.00 | مارس 2024 | صفحة API مؤرشفة |
| Claude 3 Opus (عند الإطلاق) | $15.00 | $75.00 | مارس 2024 | صفحة API مؤرشفة |
| Claude 3.5 Sonnet (عند الإطلاق) | $3.00 | $15.00 | يونيو 2024 | لقطة تسعير مؤرشفة |
| Haiku 4.5 (الأرخص حاليًا) | $1.00 | $5.00 | حالي | تسعير Claude |
| Sonnet 5 (حالي) | $2.00 | $10.00 | حالي | تسعير Claude |
| Fable 5.1 (النموذج الرائد الحالي) | $10.00 | $50.00 | حالي | تسعير Claude |
هنا لا ينخفض المنحنى ببساطة. أُطلق Claude 3 Haiku بسعر إدخال 0.25 دولار في مارس 2024؛ ويُدرَج أرخص نموذج حالي لدى Anthropic، وهو Haiku 4.5، بسعر 1.00 دولار — أي أغلى بأربعة أضعاف، لكل رمز، من الفئة الرخيصة قبل عامين. إن قرأت هذا وحده، يبدو الأمر وكأن الذكاء الاصطناعي أصبح أغلى. أما إن قرأته إلى جانب بقية هذا المقال، فيبدو شيئًا آخر: أبقت Anthropic سعر الرمز لأرخص فئة لديها ثابتًا تقريبًا مع ارتفاع طفيف بينما جعلت تلك الفئة أقدر بكثير، كما أضافت فئة رائدة جديدة وأغلى (Fable 5.1 بسعر 10.00/50.00 دولارًا) فوق ما كان Opus يمثل قمته سابقًا. نمت التشكيلة بفئات إضافية بدلًا من أن تصبح أرخص بشكل موحّد فحسب.
DeepSeek وصدمة سعر الاستدلال
دخلت DeepSeek هذا السوق بأسعار أقل بكثير من منافسَيها بالفعل. في مايو 2024، تُظهر صفحة تسعيرها المؤرشفة أن deepseek-chat، المدعوم بـ DeepSeek-V2، كان بسعر ثابت قدره 0.14 دولار للإدخال و0.28 دولار للإخراج — أرخص من أي شيء قدّمته OpenAI أو Anthropic في ذلك الوقت، قبل أن يقدّم أي منهما رمزًا أرخص من 0.25 دولار. بحلول ديسمبر 2024، كان deepseek-chat قد رُقِّي في مكانه إلى DeepSeek-V3، وقدّمت صفحة تسعير DeepSeek تقسيمًا بين إصابة التخزين المؤقت (cache-hit) وإخفاقه (cache-miss): تُظهر لقطة مؤرشفة السعر القياسي (بعد انتهاء العرض الترويجي) عند 0.07 دولار لإدخال إصابة التخزين المؤقت، و0.27 دولار لإدخال إخفاق التخزين المؤقت، و1.10 دولار للإخراج. ثم، في 20 يناير 2025، أصدرت DeepSeek نموذج R1 الاستدلالي، بسعر 0.14 دولار لإصابة التخزين المؤقت، و0.55 دولار لإخفاقه، و2.19 دولار للإخراج — وتؤكد لقطة مؤرشفة بعد ثمانية أيام هذا السعر، مستبعدًا صراحة من أي خصم ترويجي.
| النموذج | الإدخال $/مليون (إصابة / إخفاق التخزين المؤقت) | الإخراج $/مليون | مُسعَّر بتاريخ | المصدر |
|---|---|---|---|---|
| DeepSeek-V2 (deepseek-chat) | ثابت $0.14 | $0.28 | مايو 2024 | صفحة تسعير مؤرشفة |
| DeepSeek-V3 (deepseek-chat، السعر القياسي) | $0.07 / $0.27 | $1.10 | ديسمبر 2024 | صفحة تسعير مؤرشفة |
| DeepSeek-R1 (deepseek-reasoner، عند الإطلاق) | $0.14 / $0.55 | $2.19 | يناير 2025 | صفحة تسعير مؤرشفة |
| deepseek-flash (حالي، خارج الذروة) | $0.003 / $0.15 | $0.60 | حالي | توثيق تسعير DeepSeek |
| deepseek-v4-pro (حالي، خارج الذروة) | $0.022 / $0.66 | $1.98 | حالي | توثيق تسعير DeepSeek |
إطلاق R1 هو أوضح رقم منفرد في هذا المقال بأكمله: 2.19 دولار للإخراج مقابل o1 من OpenAI، وهو نموذج استدلالي مماثل، بسعر 60.00 دولارًا للإخراج — فجوة بمقدار 27 ضعفًا، والرقمان كلاهما من الجداول أعلاه. هذه المقارنة هي بالضبط ما جعل R1 قصة تتجاوز جمهور المطورين المعتاد في يناير 2025. ويستحق الأمر أيضًا ملاحظة ما تقوله أرقام DeepSeek نفسها عن الاستدلال تحديدًا: سعر إخراج R1 البالغ 2.19 دولارًا يقارب ضعف سعر V3 البالغ 1.10 دولارًا، ضمن الجهة نفسها، في اللحظة الزمنية نفسها. لا يضيف الاستدلال بسلسلة تفكير مجرد مضاعف تكلفة على مستوى الواجهة البرمجية فحسب؛ إذ يشير توثيق DeepSeek نفسه إلى أن عدد رموز إخراج النموذج الاستدلالي يشمل كل رمز من أثر تفكيره، لا الإجابة النهائية فقط، لذا يستهلك استعلام استدلالي رموز إخراج أكثر بكثير من استعلام مباشر حتى قبل تطبيق سعر الرمز. كما يضيف تسعير DeepSeek الحالي آلية لا تستخدمها أي جهة أخرى: تقارب أسعار ساعات الذروة ضعف أسعار خارج الذروة على النموذج نفسه، وهو شكل من التسعير القائم على الطلب أقرب إلى فوترة الكهرباء منه إلى قائمة أسعار ثابتة.
النمط الذي تخفيه الأرقام المسطّحة
ضع أرقام أرخص رمز متاح لدى الجهات الثلاث على خط زمني واحد وسترى أن الشكل ليس منحنى سلسًا. انخفضت فئة OpenAI الرخيصة من 20.00 دولارًا (نوفمبر 2022) نحو 0.10 دولار اليوم، بشكل شبه رتيب. أما فئة Anthropic الرخيصة فانخفضت بحدة مرة واحدة، من 1.63 دولارًا (2023، Claude Instant) إلى 0.25 دولار (مارس 2024، Claude 3 Haiku)، ثم ارتفعت مجددًا إلى 1.00 دولار (حاليًا، Haiku 4.5) مع ازدياد قدرة تلك الفئة. أما DeepSeek فدخلت السوق رخيصة بالفعل وبقيت كذلك، مع إضافة تسعير حسب وقت اليوم فوق ذلك. لا يشبه أي من منحنيات الجهات الثلاث الآخر، ولا يشبه أي منها انخفاضًا أسيًا بسيطًا بمجرد أن تتبّع فئة محددة بدلًا من «أيًا كان اسم أرخص نموذج هذا العام».
الإخراج أغلى من الإدخال، والنسبة اتسعت
عند إطلاق GPT-4 في مارس 2023، كان الإخراج يكلف ضعف الإدخال بالضبط: 60.00 دولارًا مقابل 30.00 دولارًا. انظر إلى النماذج الرائدة والمتوسطة الحالية عبر الجهات الثلاث وستجد أن النسبة اتسعت: gpt-6-astra بنسبة 5 أضعاف (50.00 دولارًا مقابل 10.00 دولارات)، وأُطلق Claude 3 Opus بنسبة 5 أضعاف (75.00 دولارًا مقابل 15.00 دولارًا) وبقي عندها حتى Haiku 4.5 (5 أضعاف، 5.00 دولارات مقابل 1.00 دولار)، والسعر القياسي لـ DeepSeek-V3 يقارب 4 أضعاف (1.10 دولار مقابل 0.27 دولار لإخفاق التخزين المؤقت). التفسير التقني المعتاد معماري لا تجاري: توليد رموز الإخراج يحدث رمزًا تلو الآخر بشكل تلقائي الانحدار (autoregressive)، بينما يمكن معالجة رموز إدخال الطلب بالتوازي في تمريرة أمامية واحدة، لذا فإن تكلفة الحوسبة الفعلية لدى المزوّد لكل رمز إخراج أعلى منها لكل رمز إدخال، وقد انجرف التسعير نحو عكس تلك الفجوة بدقة أكبر بمرور الوقت مما فعله تقسيم GPT-4 الأصلي البسيط بمضاعف 2.
خصومات التخزين المؤقت والدفعات
تُخفّض الجهات الثلاث جميعها الآن سعر الرموز التي يكون النموذج قد رآها فعليًا من قبل. تسرد صفحة تسعير OpenAI الحالية سعر إدخال gpt-6-astra المخزَّن مؤقتًا عند 1.00 دولار مقابل سعر إدخال قياسي قدره 10.00 دولارات، وهو خصم بمقدار 10 أضعاف لإعادة استخدام بادئة طلب مطابقة، وتنص بشكل منفصل على أن واجهة Batch API الخاصة بها تعالج الطلبات ضمن نافذة 24 ساعة بنصف السعر التزامني القياسي عبر النماذج المؤهَّلة. ويُظهر تسعير Anthropic الحالي سعر قراءة التخزين المؤقت للطلب في Fable 5.1 عند 0.25 دولار مقابل سعر إدخال قياسي قدره 10.00 دولارات — أي أرخص بـ 40 ضعفًا — بينما تكلف كتابة التخزين المؤقت 12.50 دولارًا، وهي علاوة فوق السعر القياسي البالغ 10.00 دولارات، لأن كتابة مُدخل تخزين مؤقت جديد تتطلب عملًا إضافيًا حقيقيًا في المرة الأولى. أما تقسيم إصابة/إخفاق التخزين المؤقت لدى DeepSeek، الموصوف أعلاه، فهو مدمج في تسعيرها الأساسي بدلًا من أن يُقدَّم كميزة منفصلة: سعر إصابة التخزين المؤقت لـ R1 البالغ 0.14 دولار مقابل سعر إخفاقه البالغ 0.55 دولار هو فرق يقارب 4 أضعاف في كل استدعاء منفرد، لا في الطلبات التي تختار ذلك فقط. بالنسبة لأي عبء عمل يكرر تعليمة نظام طويلة أو مجموعة ثابتة من تعريفات الأدوات عبر استدعاءات عديدة — كخط أنابيب فرز أمني يصنّف سطر سجل تلو الآخر مقابل التعليمات نفسها، وهو مثال واضح — تغيّر هذه الخصومات أي جهة هي الأرخص أكثر مما يفعله سعر الرمز المُعلن في العنوان.
مفارقة جيفونز: لماذا رفعت الرموز الأرخص الإنفاق الإجمالي
في عام 1865، نشر الاقتصادي ويليام ستانلي جيفونز كتاب The Coal Question (مسألة الفحم)، محتجًا بأن استهلاك بريطانيا من الفحم ارتفع، لا انخفض، بعد أن جعل محرك بخاري أكثر كفاءة في استهلاك الوقود من جيمس واط العمل بالفحم أرخص. وكما يذكر ملخص ويكيبيديا لهذه الحجة، نقلًا عن جيفونز مباشرة:
من الخلط بين الأفكار أن نفترض أن الاستخدام الاقتصادي للوقود يعادل انخفاض الاستهلاك. بل العكس هو الصحيح تمامًا.
ويليام ستانلي جيفونز، 1865، كما ورد في ويكيبيديا: مفارقة جيفونز
الحجة، التي عُمِّمت منذ ذلك الحين إلى ما هو أبعد بكثير من الفحم، هي أن جعل مورد ما أكثر كفاءة في الاستخدام يخفّض سعره الفعلي، وأن انخفاض السعر يزيد الكمية المطلوبة بأكثر مما توفره مكاسب الكفاءة — فيرتفع الاستهلاك الإجمالي. ووفق ملخص ويكيبيديا نفسه، استُحضرت هذه الحجة بالضبط على نطاق واسع في أوائل 2025 حول نموذج R1 الرخيص من DeepSeek، مع تعليقات نُقلت عن معلقين من بينهم الرئيس التنفيذي لشركة Microsoft ساتيا ناديلا والاقتصادي إريك برينيولفسون حول ما إذا كان استدلال الذكاء الاصطناعي الأرخص بشكل جذري سيقلّص أو يوسّع إجمالي الموارد المُنفقة على الذكاء الاصطناعي. نعتمد هنا على ذلك الملخص الثانوي للتعليقات المذكورة بدلًا من دراسة اقتصادية أولية تقيس الأثر الإجمالي، وادّعاء أن إنفاق الصناعة على الذكاء الاصطناعي يرتفع بسبب الرموز الأرخص — لا رغم طفرة طلب منفصلة وغير مرتبطة — تفسير محل نقاش، لا إحصائية مستقرة. ما تدعمه جداول الأسعار أعلاه مباشرة هو الشرط المسبق للحجة: الاستعلام نفسه الذي كلّف عشرات الدولارات من الحوسبة عام 2022 يمكن أن يكلف سنتات اليوم، لدى كل جهة، وهذا بالضبط نوع انهيار الأسعار الذي سبق تاريخيًا ارتفاع الاستهلاك لا انخفاضه.
ماذا يعني هذا لتشغيل الذكاء الاصطناعي محليًا بدلًا من السحابة
كل سعر في هذا المقال هو تكلفة مقاسة لكل استدعاء تفوترها شركة تتلقى بالضرورة طلبك للإجابة عنه — وهذا هو جوهر استدعاء واجهة برمجية. أما النموذج الذي يعمل بالكامل على جهازك الخاص فلا يترتب عليه فاتورة لكل رمز بعد أن تدفع ثمنه أو تنزّله مرة واحدة، وليس لديه ما يرسله إلى أي مكان، لأنه لا توجد نقطة نهاية بعيدة في مسار الطلب من الأساس. هذا ليس ادّعاءً بأن النماذج العاملة على الجهاز تضاهي الفئات الرائدة المُسعَّرة أعلاه؛ فنموذج صغير بما يكفي ليعمل بارتياح على حاسوب محمول لن يتفوق في الاستدلال على Fable 5.1 أو gpt-6-astra. إنها مقايضة مختلفة: تكلفة ثابتة وحدود خصوصية راسخة، مقابل أي قدرة تناسب الذاكرة المتوفرة لديك فعليًا.
هذه المقايضة ليست مجردة؛ إنها المقايضة نفسها التي يقوم بها نموذج صغير ومحدود النطاق عاملٌ على الجهاز داخل قطعة من برمجيات الأمن. يشحن FireAI، جدار الحماية الخاص بـ HisnLabs لأجهزة Mac، نموذجًا محليًا اختياريًا مهمته الوحيدة مراجعة اتصال من تطبيق لا توجد له قاعدة بعد — وهي مهمة أصغر نطاقًا بكثير من أي شيء مُسعَّر في الجداول أعلاه، ويعمل فيها النموذج على جهاز الـ Mac نفسه بدلًا من استدعاء أي من هذه الواجهات البرمجية. الهدف من استعراض تاريخ أسعار OpenAI وAnthropic وDeepSeek بهذا القدر من التفصيل ليس الترويج لذلك التصميم؛ بل جعل المقايضة ملموسة: اشترت رموز السحابة قدرة أكبر بكثير مقابل مال أقل بكثير بين عامي 2022 و2026، وعند كل نقطة سعرية من تلك النقاط، كان استخدامها لا يزال يعني إرسال بياناتك إلى خادم شخص آخر للحصول على إجابة.
دور FireAI وHisnLabs
None of this makes FireAI a cost story — it is a firewall, not a rented model — but the same bet sits underneath its own on-device reviewer: no per-token bill and nothing sent off the Mac, because the review happens locally instead of being shipped to a server.
FireAI هو منتج HisnLabs نفسها: جدار حماية بذكاء اصطناعي يعمل على جهاز Mac مباشرة. يعرض بلغة واضحة كل اتصال تجريه تطبيقاتك، ويترك لك القرار فيما يخرج من جهازك — ذكاؤه الاصطناعي يعمل محليًا، فلا يُرسَل ترافيكك إلينا ولا إلى أي جهة أخرى أبدًا. فريق أبحاث الأمن في HisnLabs هو من يحافظ على دقة هذه القرارات: يصنّف النطاقات بين قياس عن بُعد عادي وخدمة حقيقية، ويتتبّع بلد وشبكة كل اتصال، ويدرّب النموذج المحلي (ميزة Autopilot) على حركة اتصال حقيقية، دون أن يغادر أي شيء جهاز Mac.
يمكنك الاطلاع على القرارات التقنية وراء ذلك، أو تجربة FireAI لمدة 17 يومًا، على FireAI من HisnLabs.
