بات تسعير رموز الذكاء الاصطناعي يُعيد تشكيل طريقة إدارة المؤسسات لميزانياتها التقنية، إذ تحوّلت كلمة “السياق” من مفهوم لغوي إلى وحدة قياس للفوترة تهيمن على الإنفاق المؤسسي في مجال الذكاء الاصطناعي. وتقف هذه الكلمة في قلب تحوّل جذري يؤثر على كل مؤسسة تعتمد على نماذج اللغة الكبيرة.

كيف تحوّل السياق إلى وحدة فوترة في تسعير رموز الذكاء الاصطناعي

تُعرّف شركات الذكاء الاصطناعي الكبرى الرمز (Token) بوصفه أصغر وحدة معلومات تعالجها النماذج، وتتراوح بين حرف واحد وكلمة شائعة كاملة. وتنص وثائق Google Gemini API على أن الفوترة تُحدَّد بعدد رموز الإدخال والإخراج، حيث يعادل الرمز الواحد نحو أربعة أحرف نصية، أو ما بين 60 و80 كلمة إنجليزية لكل 100 رمز. وتصف IBM نافذة السياق بأنها مكافئ الذاكرة العاملة للنموذج، فيما تصف NVIDIA الرموز بأنها عملة الذكاء الاصطناعي.

فجوة تسعير تبلغ 72 ضعفاً بين النماذج الكبرى

تكشف مقارنة الأسعار عبر النماذج الحدودية عن فجوة واسعة. يبلغ سعر إخراج GPT-5.4 Pro نحو 180 دولاراً لكل مليون رمز، في حين لا يتجاوز سعر إخراج Gemini 2.5 Flash 2.50 دولار لكل مليون رمز، وهو فارق يبلغ 72 ضعفاً لوحدة يصفها السوق بالكلمة ذاتها. وتحمل GPT-5.4 نافذة سياق تبلغ 1,050,000 رمز، غير أن الطلبات التي تتجاوز 272,000 رمز إدخال تُحتسب بضعف السعر القياسي للإدخال و1.5 ضعف سعر الإخراج القياسي للجلسة بأكملها.

قدّمت Anthropic نموذج Claude Opus 4.6 بنافذة سياق تبلغ مليون رمز في مرحلة تجريبية، مع الإبقاء على الأسعار عند 5 دولارات للإدخال و25 دولاراً للإخراج لكل مليون رمز. بيد أن الطلبات التي تتجاوز 200,000 رمز إدخال تستوجب رسوماً إضافية مضاعفة على الإدخال و1.5 ضعف على الإخراج، ما يرفع الأسعار الفعلية إلى 10 دولارات للإدخال و37.50 دولاراً للإخراج لكل مليون رمز في جلسات السياق الطويل. في المقابل، يدعم Grok 4.1 Fast من xAI نافذة تبلغ مليوني رمز بسعر 0.20 دولار للإدخال و0.50 دولار للإخراج.

النماذج مفتوحة الأوزان وخيار الاستضافة الذاتية

تقدّم نماذج Meta مفتوحة الأوزان هيكل تكلفة مختلفاً. يدعم Llama 4 Scout نافذة سياق تبلغ 10 ملايين رمز، بأسعار واجهة برمجة التطبيقات تبدأ من 0.08 دولار لكل مليون رمز إدخال و0.30 دولار لكل مليون رمز إخراج عبر OpenRouter، وهي من أدنى الأسعار في سوق النماذج الحدودية. ويوفر Llama 4 Maverick نافذة مليون رمز بسعر 0.15 دولار للإدخال و0.60 دولار للإخراج، مع إتاحة النموذج للاستضافة الذاتية بموجب رخصة مجتمعية.

تؤثر منصة النشر أيضاً على نافذة السياق المتاحة. توثّق Oracle نموذج Grok 4 على بنيتها التحتية السحابية بنافذة سياق تبلغ 128,000 رمز، أي نصف النافذة البالغة 256,000 رمز المتاحة عبر واجهة xAI الخاصة. يحمل النموذج ذاته سقفَي سياق مختلفَين بحسب منصة النشر، وهو تناقض هيكلي يُعقّد التخطيط المؤسسي.

“هندسة السياق هي مجموعة الاستراتيجيات لاختيار المجموعة المثلى من الرموز والحفاظ عليها أثناء استدلال النماذج اللغوية الكبيرة.”

فريق هندسة Anthropic

ما لا يقيسه تسعير رموز الذكاء الاصطناعي: جودة البنية العلائقية

يُسعّر السوق الطاقة الاستيعابية، أي عدد الرموز التي يمكن للنموذج معالجتها دفعةً واحدة. غير أنه لا يُسعّر ما إذا كانت البنية العلائقية داخل تلك الرموز متماسكة أو سليمة معرفياً. فالنموذج الذي يتلقى كتلة كبيرة من المستندات المنسوخة لا يعادل نموذجاً يعمل ضمن تمثيل منظّم للمعرفة، مع أن عدد الرموز يرتفع بالقدر ذاته في الحالتين، ولا تُميّز الفاتورة بينهما.

استجابت فرق الهندسة بتطوير استراتيجيات ضغط. تصف إحدى المناقشات التقنية أسلوب استخراج توقيعات الدوال والأنواع والتوثيق من الكود المصدري بدلاً من تمرير الملفات كاملةً، ما يُقلّص تمثيل الرمز النموذجي للدالة من 50 إلى 8 رموز، أي توفيراً ستة أضعاف في التكلفة مع الحفاظ على البنية العلائقية. ومع ذلك، يظل الفارق الدلالي بين البنية العلائقية وحجم النص الخام بلا آلية تسعير مستقلة، إذ يُقاس كلاهما بالكلمة ذاتها.

تُشير وثائق الاقتصاد الرقمي إلى أن مؤسسات الذكاء الاصطناعي تواجه تحدياً مزدوجاً: دفع تكاليف متصاعدة لنوافذ سياق أوسع، مع غياب أي ضمان بأن الرموز الإضافية تُحسّن جودة الاستدلال. ومع توسّع اعتماد الذكاء الاصطناعي على مستوى المؤسسات، تبقى الفجوة بين ما يقيسه تسعير الرموز وما تحتاجه المؤسسات فعلياً من أنظمتها دون حلّ.