أول حاجة بتقابلك في أسعار الذكاء الاصطناعي: «X جنيه لكل مليون توكن». طيب يعني إيه توكن؟ وإزاي تترجم الرقم ده لتكلفة حقيقية لمشروعك؟ الشرح ده هيخليك تحسب بثقة.
يعني إيه توكن؟
التوكن هو قطعة صغيرة من النص — ممكن تكون كلمة كاملة، جزء من كلمة، أو علامة ترقيم. النماذج بتقرأ وتكتب بالتوكنز مش بالكلمات. كقاعدة تقريبية:
- في الإنجليزي: 1000 توكن ≈ 750 كلمة.
- في العربي: 1000 توكن ≈ 350-500 كلمة (العربي بيستهلك توكنز أكتر شوية).
توكنز الإدخال vs الإخراج
كل طلب ليه نوعين من التكلفة:
- الإدخال (Input): كل اللي بتبعته للنموذج — سؤالك + التعليمات + سياق المحادثة.
- الإخراج (Output): الرد اللي النموذج بيكتبه — وده دايمًا أغلى من الإدخال (غالبًا 3-5 أضعاف).
عشان كده الطلبات اللي بتطلب ردود طويلة بتكلف أكتر من اللي بتطلب ردود مختصرة، حتى لو السؤال نفس الطول.
مثال حسابي عملي
افرض بتبني شات بوت خدمة عملاء بيرد على 1000 رسالة يوميًا:
- متوسط الإدخال: 300 توكن للرسالة (سؤال + تعليمات).
- متوسط الإخراج: 150 توكن (رد مختصر).
- الإجمالي الشهري: 9 مليون توكن إدخال + 4.5 مليون إخراج.
على موديل mini اقتصادي، ده بيطلع عشرات الجنيهات في الشهر — مش مئات. قارن الأسعار الفعلية لكل نموذج في صفحة النماذج.
4 حيل لتقليل استهلاك التوكنز
- قصّر التعليمات (System Prompt): بتتبعت مع كل طلب — كل كلمة زيادة بتتكرر آلاف المرات.
- حدد طول الرد: اطلب «رد في 3 جمل» أو استخدم max_tokens.
- قصّ ذاكرة المحادثة: مش لازم تبعت كل المحادثة القديمة — آخر 5-10 رسائل كفاية غالبًا.
- استخدم النماذج المصغرة للمهام البسيطة — الفرق في السعر بيوصل 20 ضعف.
احسبها من غير ما تدفع
داخل بوابة النماذج الاصطناعية فيه حاسبة تكلفة: تلصق أي نص وتختار النموذج، وتشوف فورًا عدد التوكنز والتكلفة بالجنيه قبل ما تبعت أي طلب. وكل طلب حقيقي بيتسجل في سجل الاستخدام بتكلفته بالتفصيل — شفافية كاملة.
ابدأ من الدليل المبسط للمبتدئين لو لسه جديد، أو سجّل وجرب الحاسبة بنفسك.