كيف تُحسب تكلفة استخدام الذكاء الاصطناعي؟
كيف تُحسب تكلفة استخدام الذكاء الاصطناعي؟
دليل مبسّط لفهم الرموز والتكلفة والحدود
عندما تكتب سؤالًا إلى نموذج ذكاء اصطناعي، فإنه لا يتعامل مع النص بوصفه كلمات كاملة كما نقرأها نحن، بل يقسّمه إلى وحدات صغيرة تسمّى:
الرموز — Tokens
وفهم هذه الرموز يساعدك على:
• معرفة سبب ارتفاع تكلفة بعض الاستخدامات.
• كتابة تعليمات أكثر كفاءة.
• اختيار النموذج المناسب للمهمة.
• تقليل استهلاك واجهات البرمجة API.
• فهم سبب توقف بعض الطلبات أو تباطئها.
________________________________________
أولًا: ما الرمز؟
الرمز هو وحدة نصية صغيرة يعالجها النموذج.
قد يكون الرمز:
• كلمة قصيرة.
• جزءًا من كلمة.
• علامة ترقيم.
• رقمًا.
• مساحة أو جزءًا من جملة.
مثال تقريبي:
الجملة:
حلّل هذا النص.
لا تُحسب بالضرورة على أنها ثلاث كلمات فقط، بل يقسّمها النموذج إلى عدد من الرموز وفق طريقة الترميز التي يستخدمها.
وقد تستهلك اللغة العربية رموزًا أكثر من النص الإنجليزي المقابل في بعض أنظمة الترميز.
________________________________________
ثانيًا: ما الذي يدخل في حساب الرموز؟
لا يُحسب سؤالك الأخير وحده، بل قد يشمل الاستهلاك:
1. تعليمات النظام التي تضبط عمل النموذج.
2. تعليمات البوت أو المساعد الذكي.
3. الرسائل السابقة في المحادثة.
4. السؤال الجديد الذي كتبته.
5. الملفات والصور المرفقة.
6. الإجابة التي يولّدها النموذج.
ولهذا قد تكون رسالتك قصيرة، لكن الاستهلاك الفعلي كبير؛ لأن المحادثة السابقة والتعليمات والملفات تدخل في المعالجة أيضًا.
________________________________________
ثالثًا: ما الفرق بين رموز المدخلات والمخرجات؟
تنقسم الرموز عادة إلى نوعين:
1. رموز المدخلات
وهي كل ما ترسله إلى النموذج، مثل:
• السؤال.
• التعليمات.
• سجل المحادثة.
• النصوص والملفات المرفقة.
2. رموز المخرجات
وهي الإجابة التي ينشئها النموذج.
وفي واجهات البرمجة المدفوعة، تُحسب تكلفة المدخلات والمخرجات بصورة منفصلة، وقد تكون رموز المخرجات أعلى تكلفة من رموز المدخلات.
________________________________________
رابعًا: لماذا تزداد التكلفة مع استمرار المحادثة؟
تخيّل أنك بدأت محادثة طويلة تضمنت:
• تعليمات مفصّلة.
• عدة أسئلة.
• إجابات طويلة.
• ملفات مرفقة.
• تعديلات متكررة.
عند إرسال سؤال جديد، قد يحتاج النموذج إلى قراءة جزء كبير من السياق السابق حتى يفهم طلبك.
وهذا يعني أن المحادثة الطويلة قد تستهلك رموزًا أكثر من محادثة جديدة ومختصرة.
مثال مبسّط
إذا أرسلت:
• سؤالًا أول.
• ثم سؤالًا ثانيًا.
• ثم سؤالًا ثالثًا.
فقد يتضمن الطلب الثالث السؤالين السابقين وإجابتيهما، وليس السؤال الثالث وحده.
________________________________________
خامسًا: ما نافذة السياق؟
نافذة السياق هي الحد الأقصى من المعلومات التي يستطيع النموذج التعامل معها في جلسة واحدة.
وتشمل:
• التعليمات.
• المحادثة السابقة.
• الملفات والنصوص.
• إجابة النموذج.
عند امتلاء نافذة السياق قد يحدث أحد الأمور الآتية:
• حذف بعض الأجزاء القديمة.
• تلخيص المحادثة.
• رفض النص الطويل.
• ضعف تذكّر التفاصيل السابقة.
• الحاجة إلى بدء محادثة جديدة.
إذن:
نافذة السياق تحدد مقدار ما يستطيع النموذج الاحتفاظ به أثناء المعالجة، وليست ذاكرة دائمة لكل ما قيل.
________________________________________
سادسًا: ما حدود المعدل؟
حتى لو كانت لديك ميزانية كافية، قد توجد حدود لعدد الطلبات أو الرموز التي تستطيع استخدامها خلال مدة معينة.
ومن أشهرها:
RPM
عدد الطلبات المسموح بها في الدقيقة.
TPM
عدد الرموز التي يمكن معالجتها في الدقيقة.
TPD
عدد الرموز التي يمكن استخدامها في اليوم.
تُستخدم هذه الحدود لتنظيم الأحمال، ومنع إساءة الاستخدام، وتوزيع الموارد بين المستخدمين.
________________________________________
سابعًا: لماذا لا نستخدم أقوى نموذج في كل مهمة؟
ليست كل مهمة بحاجة إلى نموذج مرتفع القدرة.
فمثلًا:
• تصنيف النص إلى مناسب أو غير مناسب: نموذج خفيف.
• استخراج أسماء من جدول: نموذج خفيف.
• تلخيص رسالة قصيرة: نموذج خفيف أو متوسط.
• تحليل بحث علمي معقد: نموذج أقوى.
• مراجعة كود كبير: نموذج متخصص أو مرتفع القدرة.
• بناء قرار متعدد المعايير: نموذج أكثر قدرة على الاستدلال.
استخدام نموذج ضخم في مهمة بسيطة يشبه استخدام حاسوب خارق لإجراء عملية جمع صغيرة.
قد تحصل على النتيجة، لكن بتكلفة أعلى من اللازم.
________________________________________
ثامنًا: كيف تقلّل استهلاك الرموز؟
يمكنك تطبيق الخطوات الآتية:
1. حدّد المطلوب بوضوح
بدلًا من:
تحدث عن الذكاء الاصطناعي.
اكتب:
عرّف الذكاء الاصطناعي للمبتدئ في 80 كلمة، مع مثال واحد.
________________________________________
2. حدّد طول الإجابة
مثل:
• أجب في خمس نقاط.
• لخّص في 100 كلمة.
• قدّم جدولًا من ثلاثة أعمدة.
• أعطني مثالين فقط.
تحديد الطول يمنع التوسع غير الضروري.
________________________________________
3. لا تكرر التعليمات
إذا كانت التعليمات موجودة أصلًا في البوت، فلا حاجة إلى نسخها في كل رسالة.
________________________________________
4. لخّص المحادثات الطويلة
بعد عدد من الجولات، يمكنك أن تطلب:
لخّص ما اتفقنا عليه في نقاط، وسنواصل العمل اعتمادًا على الملخص.
________________________________________
5. افتح محادثة جديدة عند تغيّر الموضوع
الانتقال من موضوع البحث العلمي إلى تصميم إعلان داخل المحادثة نفسها قد يحمل سياقًا قديمًا لا تحتاج إليه.
________________________________________
6. استخدم النموذج المناسب
ابدأ بالنموذج الأخف للمهمة البسيطة، وانتقل إلى النموذج الأقوى عندما تحتاج إلى تحليل أو استدلال أكثر تعقيدًا. ويُعد اختيار النموذج وتقليص السياق وتحديد طول الإجابة من أبرز وسائل تقليل الاستهلاك.
________________________________________
تاسعًا: أخطاء شائعة ترفع التكلفة
من أبرز الأخطاء:
• استخدام نموذج قوي لمهمة بسيطة.
• إرسال ملفات كاملة مع أن المطلوب موجود في صفحة واحدة.
• الاحتفاظ بمحادثة طويلة لموضوعات مختلفة.
• طلب إجابة دون تحديد الطول.
• تكرار تعليمات طويلة في كل رسالة.
• إرفاق صور عالية الدقة دون حاجة.
• إعادة إرسال النص نفسه عدة مرات.
• طلب عدة عمليات معقدة في كل جولة دون تنظيم.
________________________________________
عاشرًا: قاعدة عملية للمبتدئ
قبل إرسال أي طلب، اسأل نفسك:
ما المهمة؟
هل أريد تلخيصًا، تحليلًا، ترجمة، تصنيفًا، أم إنشاء محتوى؟
ما المعلومات الضرورية؟
أرسل ما يحتاجه النموذج فقط.
ما حجم النتيجة؟
حدّد عدد الكلمات أو النقاط أو الصفوف.
ما مستوى النموذج المطلوب؟
لا تستخدم نموذجًا مرتفع القدرة إلا عندما تستدعي المهمة ذلك.
________________________________________
مثال قبل التحسين
اقرأ هذا الملف وأخبرني بكل شيء عنه.
مثال بعد التحسين
اقرأ القسم الثاني من الملف، واستخرج منه خمس أفكار رئيسة في جدول، مع شرح لا يتجاوز سطرين لكل فكرة.
الطلب الثاني:
• أوضح.
• أقصر.
• أسهل في التنفيذ.
• أقل استهلاكًا للرموز.
• أكثر احتمالًا لإنتاج نتيجة دقيقة.
________________________________________
الخلاصة التعليمية
الرموز هي الوقود الذي تعتمد عليه النماذج في قراءة المدخلات وإنتاج الإجابات.
كلما زادت:
• التعليمات.
• المحادثات السابقة.
• الملفات.
• الصور.
• الإجابات الطويلة.
زاد استهلاك الرموز، وقد ترتفع التكلفة.
لذلك لا تعني الكفاءة أن تكتب أقل عدد ممكن من الكلمات فقط، بل أن تكتب:
تعليمات واضحة، محددة، كافية، وخالية من التكرار.
________________________________________
4
6 comments
Abdulrahman Alzarraei
7
كيف تُحسب تكلفة استخدام الذكاء الاصطناعي؟
powered by
Arab Ai Models  النماذج الذكية
نماذج مخصّصة صُمّمت لتمكين أصحاب المشاريع من توظيف الذكاء الاصطناعي بطريقة عملية، تخلق قيمة حقيقية، لتحقيق الدخل وتطوير الأعمال دون تعقيد تقني.
Build your own community
Bring people together around your passion and get paid.
Powered by