رموز الإدخال
رموز الإدخال تمثّل المحتوى المقدَّم في طلب واحد. وقد يشمل ذلك تعليمات النظام والمطوّر، وأحدث رسالة من المستخدم، وأدوار المحادثة السابقة، والمستندات المسترجعة، وتعريفات الأدوات، ونتائج الأدوات، والصور أو المقاطع الصوتية المُرمّزة عندما يكون النموذج قادرًا على قبولها.
تصف كلمة «إدخال» اتجاه البيانات، لا الجهة التي كتبتها. فقد يكتب المستخدم جملة قصيرة واحدة، بينما يرسل التطبيق في الخفاء طلبًا أكبر بكثير يحيط بها.
يظل الإدخال المخزّن مؤقتًا إدخالًا. قد يغيّر التخزين المؤقت سعره أو طريقة ظهوره في تقرير الاستخدام، لكنه لا يحوّل المحتوى إلى إخراج ولا يزيله من سياق العمل لدى النموذج.
رموز الإخراج
رموز الإخراج تُنشأ أثناء الاستجابة. فالنص البرمجي والنثر المرئيان يُعدّان إخراجًا، وكذلك البُنى المُنشأة مثل استدعاءات الأدوات. وبحسب مصطلحات المزوّد، قد يشمل إجمالي الإخراج المُبلّغ عنه أيضًا الاستدلال الداخلي وغيره من الرموز المُنشأة غير المرئية.
ولهذا لا يُعدّ النص الظاهر على الشاشة عدّادًا موثوقًا للرموز. فقد تعرض الاستجابة 180 رمزًا من النثر، بينما يسجّل تقرير الاستخدام إجماليًا أكبر بكثير من الرموز المُنشأة.
رموز الاستدلال
رموز الاستدلال، التي تُسمّى أحيانًا رموز التفكير، تُنشأ داخليًا أثناء تخطيط نموذج الاستدلال لمهمة ما أو تحقّقه منها أو معالجته لها. وهي ليست محتوى إضافيًا في الطلب، ولا تُعرض لك بالضرورة.
قد يخفي المزوّد الاستدلال أو يحذفه أو يعيد ملخّصًا له. والملخّص هو عرض للعملية، وليس دليلًا على أنك تلقيت كل رمز من رموز الاستدلال الداخلية. وتُظهر وثائق OpenAI وAnthropic وGoogle الحالية أنها تحسب كامل العمل الداخلي، حتى عندما لا يُعاد النص الكامل.
لا يكشف كل نموذج أو واجهة API عن عدد رموز الاستدلال. فبعض النماذج يُنشئ إجابة من دون مرحلة استدلال تُبلّغ عنها بشكل منفصل. وتدعم نماذج أخرى عناصر تحكّم تؤثر في جهد الاستدلال، لكن هذه العناصر لا تضمن مقدارًا دقيقًا من التفكير ما لم يصرّح المزوّد بذلك صراحةً.
التمييز الفعلي
تجيب التسميات الثلاث عن أسئلة مختلفة:
| Token type | Defining question | Typical contents | Usually visible? | Accounting relationship |
|---|---|---|---|---|
| Input | What did this request send to the model? | Instructions, messages, context, tools, files | Mostly, though applications can add content | A top-level request category; cached input may be a priced subset |
| Output | What did the model generate? | Answer text, code, tool calls, and sometimes internal generated work | Partly | Can be an inclusive total or an answer-only field, depending on the API |
| Reasoning | What internal generated work helped produce the answer? | Planning, intermediate work, checks | Often hidden or summarized | Commonly a subset of generated output for billing, but sometimes reported beside output |
الإدخال والإخراج المُنشأ هما جانبان متقابلان من الطلب. أما الاستدلال فهو نوع من النشاط المُنشأ؛ ولذلك لا يشكّل فئة ثالثة عامة إلى جانب الإدخال والإخراج.
يهم هذا التمييز عند مقارنة لوحات معلومات المزوّدين. توثّق OpenAI الاستدلال كتفصيل ضمن عدد إخراج شامل. وتصف Anthropic رموز التفكير بالطريقة نفسها، أي باعتبارها جزءًا من إجمالي الإخراج المعتمد لديها. أما Google فتعرض إخراج المرشّح وعدد رموز التفكير بشكل منفصل، وتقول إن تسعير الاستجابة يجمع بينهما. تختلف أسماء الحقول، لكن المزوّدين الثلاثة يعاملون الاستدلال بوصفه عملًا مُنشأً.
مثال عملي على الاستخدام
لنفترض هذا الطلب المبسّط:
- يبلغ مجموع التعليمات ورسالة المستخدم والسجل والسياق المرفق 1,200 رمز إدخال.
- ينشئ النموذج 620 رمزًا للاستدلال.
- ثم ينشئ إجابة مرئية من 180 رمزًا.
قد تعرض إحدى واجهات API ما يلي:
input_tokens: 1200
output_tokens: 800
output_details.reasoning_tokens: 620في هذه الحالة، يكون output_tokens شاملًا. لا تضف الرموز الـ620 مرة أخرى؛ فالإجابة المؤلفة من 180 رمزًا هي الجزء غير الخاص بالاستدلال من إجمالي الرموز المُنشأة البالغ 800 رمز.
وقد تعرض واجهة API أخرى ما يلي:
input_tokens: 1200
output_tokens: 180
thought_tokens: 620
total_tokens: 2000في هذه الحالة، يكون إخراج الإجابة ورموز التفكير حقلين منفصلين. ويجب تضمين كليهما عند تقييم الاستخدام المُنشأ. ويصف التقريران التدفق المبسّط نفسه:
1,200 input + 620 reasoning + 180 visible answer = 2,000 total tokensإذا كانت جميع الرموز المُنشأة تستخدم سعر المزوّد الخاص بالإخراج، فإن حساب التكلفة المبسّط يكون:
(1,200 × input rate) + (800 × output rate)قد تضيف الفواتير الفعلية أسعارًا منفصلة للإدخال المخزّن مؤقتًا، وعمليات كتابة ذاكرة التخزين المؤقت، والدفعات، والأدوات، أو ميزات أخرى. استخدم مخطط الاستخدام وقواعد التسعير الخاصة بواجهة API بدلًا من افتراض أن كل حقل قابل للجمع.
متى يكون لكل نوع من الرموز أهمية؟
تكون رموز الإدخال مهمة عندما تحمل الطلبات قدرًا كبيرًا من السياق.فقد تهيمن السجلات الطويلة والمستندات وتعريفات الأدوات والتعليمات المتكررة على الاستخدام، حتى عندما تكون أحدث رسالة من المستخدم قصيرة. كما تخبرك أعداد الإدخال بمقدار المساحة المتبقية في نافذة السياق.
تكون رموز الإخراج مهمة عندما تكون الاستجابات طويلة أو تُنشأ بصورة متكررة.يحدث الإنشاء خطوةً بخطوة، ولذلك يختلف الإخراج غالبًا عن الإدخال في خصائص الأداء والتسعير. فسير عمل يصنّف مستندًا إلى تسمية واحدة يختلف في نمط استخدامه عن سير عمل يكتب مسودة تقرير.
تكون رموز الاستدلال مهمة عندما تتطلب المهمة عملًا داخليًا.فقد تأتي إجابة نهائية قصيرة بعد مسار استدلال طويل. ويمكن أن يؤدي ذلك إلى زيادة التكلفة وتأخير الإجابة المرئية واستهلاك سعة الرموز المُنشأة، من دون أن يجعل الاستجابة المعروضة أطول.
بالنسبة إلى نماذج الاستدلال، قد يشمل حدّ الإخراج كلاً من الاستدلال الداخلي والاستجابة المرئية. وإذا استهلك الاستدلال الحصة أولًا، فقد يعيد النموذج إجابة قصيرة أو غير مكتملة. تحقّق من وثائق نقطة النهاية قبل اعتبار حدّ الإخراج طولًا مضمونًا للإجابة.
أمور يخلط الناس بينها
رموز الاستدلال ليست إدخالًا إضافيًا
ينشئ النموذج رموز الاستدلال أثناء الإنشاء. وقد تصبح إدخالًا في دور لاحق إذا أرسل التطبيق محتوى التفكير المحفوظ مرة أخرى، لكن ذلك طلب جديد بحدّ قياس جديد.
رموز الاستدلال ليست منفصلة دائمًا عن رموز الإخراج
إذا أوضح كائن الاستخدام أن الاستدلال تفصيل ضمن الإخراج، فإن جمع الحقلين يؤدي إلى احتساب مزدوج. أما إذا أبلغ عن الأفكار إلى جانب إخراج الإجابة، فإن تجاهل حقل الأفكار يؤدي إلى نقص في الحساب. اقرأ المخطط قبل إجراء العمليات الحسابية.
رموز الإخراج ليست دائمًا كلمات مرئية
الرموز ليست مماثلة للكلمات، ولا يقتصر الاستخدام المُنشأ على النثر المعروض. فقد توسّع وسائط استدعاء الأدوات، والاستدلال المخفي، والتنسيقات التي يديرها المزوّد الفجوة بين ما تراه وما يسجّله العداد.
الإجابة القصيرة ليست بالضرورة إجابة منخفضة التكلفة
الطول المرئي ليس سوى جزء واحد من الاستخدام. فقد يتضمن الطلب إدخالًا كبيرًا أو استدلالًا داخليًا كبيرًا أو كليهما. ويُعدّ سجل استخدام الاستجابة أساسًا أفضل للقياس من حجم الإجابة المُنسّقة والمعروضة.
إلى أين تذهب بعد ذلك؟
اقرأ ما رموز الإدخال؟ لفهم ما تضعه التطبيقات في الطلب. واقرأ ما رموز الإخراج؟ لمعرفة المزيد عن الاستجابات المُنشأة والحدود. واقرأ ما رموز الاستدلال؟ لفهم طبقة التفكير المعتمدة على المزوّد.