أوضاع التفكير — متى تفكر، ومتى تتخطى

'التفكير' بيعني إيه فعلاً عبر النماذج

4 دقيقة للقراءة

كل vendor كبير دلوقتي بيشحن reasoning mode. Anthropic بتسمّيه extended thinking. Google بتسمّي variant بتاع Gemini thinking. وبتاع OpenAI بيتعرض كإعداد reasoning effort. اللغة التسويقية شبه بعضها عبر التلاتة. الـmechanism الفعلي شبه بعضه كمان. الـcost profile والـuse case الصح بيختلفوا.

الـmechanism المشتركة

في التلات implementations، "التفكير" بيعني إن النموذج بيطلّع reasoning trace مخفي قبل ما يطلّع الإجابة المرئية للمستخدم. الـtrace ممكن يبقى طويل جداً — مئات أو آلاف الـtokens من الـmonologue الداخلي. إنت بتدفع للـtokens دي (بتتحسب من cost الـoutput عند Anthropic، وكـ"reasoning tokens" عند OpenAI)، والإجابة المرئية بتوصل متأخرة أصل الـtrace بيتولّد الأول.

الـtrace ده chain-of-thought حقيقي. النموذج مسموح له يرجع ورا، يناقض نفسه، يجرّب طرق كتير، ويرمي اللي فشل. الإجابة المرئية بس هي اللي النموذج وصل واثق منها.

ده مختلف عن chain-of-thought المهندَس بالـprompt (نمط "think step by step" من كورس الأساسيات). الـCoT بالـprompt هو forward pass واحد بالـreasoning مكتوب في الـoutput المرئي. الـthinking modes اللي بيشحنها الـvendors فيها phase مخفية منفصلة، والإجابة بعد التفكير.

كل vendor بيسمّيه إيه

الـvendorاسم الـmodeالـAPI surfaceنموذج التسعير
AnthropicExtended thinkingthinking: { type: "enabled", budget_tokens: N } — parameter على call بتاع Claude عادي. إنت بتحدد ميزانية tokens.thinking tokens بتتحسب كـoutput tokens
OpenAIReasoning effortreasoning_effort — parameter على النماذج اللي بتدعم الـreasoning. إنت بتحدد مستوى، مش ميزانية.reasoning tokens بتتسجّل منفصلة في الـusage
GoogleThinkingإعداد thinking جوه الـgeneration config. Gemini 2.5 بياخد ميزانية tokens؛ خط 3.x بياخد مستوى.thinking tokens بتتحسب كـoutput tokens

أول حاجة تلاحظها إن الجدول ده كان شكله مختلف قبل كده، وهيتغيّر تاني. نسخة أقدم من الدرس ده كانت بتعلّم إن OpenAI هي الشاذة — إن التفكير عندهم معناه إنك تحوّل لعيلة نماذج منفصلة خالص، بينما Anthropic و Google بيعرضوه كـflag. ده كان صح في عصر سلسلة الـo. مش وصف آمن لخط OpenAI الحالي، اللي فيه الـreasoning effort إعداد على نفس النموذج وتقدر تنزّله لصفر فيتصرّف النموذج زي أي نموذج عادي. وGoogle اتحركت كمان، من ميزانية tokens رقمية في جيل 2.5 لمستوى بالاسم في 3.x.

يعني المهارة الباقية مش إنك تحفظ 3 صفوف. هي إنك تعرف أنهي سؤالين تسألهم لأي reasoning mode عند أي vendor، لأن الإجابات هي اللي الكود بتاعك بيعتمد عليها:

  1. ده نموذج منفصل، ولا إعداد على النموذج اللي بنداه أصلاً؟ ده بيحدد هل التفعيل تغيير سطر واحد ولا تغيير routing.
  2. بتحكم فيه بميزانية tokens ولا بمستوى بالاسم؟ الميزانية رقم بتظبطه قبال التكلفة. المستوى قائمة ثابتة. الكود المكتوب على واحد فيهم ما بينقلش للتاني.

الإجابتين موجودين في توثيق الـreasoning بتاع كل vendor — Anthropic، OpenAI، Google — والصفحات دي بتتصحّح لما الشكل يتغيّر. الصفحة دي لأ.

اللي فضل صح عبر كل نسخة من التلاتة: التفكير بيضيف latency tax وcost tax. الردود ممكن تاخد عشرات الثواني في المسائل الصعبة قبال ثانية أو اتنين لنفس الـprompt من غيره، وإنت بتدفع للـtrace المخفي سواء الإجابة المرئية اتغيّرت ولا لأ.

إمتى الـlatency والـcost يستاهلوا

الإجابة الصريحة: أقل من اللي التسويق بيقوله. أغلب الـprompts بتاعة الـproduction هي إعادة كتابة نبرة، classifications، تلخيصات، structured extractions — مهام النموذج الأساسي عنده الإجابة فيها في forward pass واحد. إنك تضيف thinking للمهام دي ده دفع في feature ما بتستخدمهاش.

الـthinking بيستاهل لما المهمة فيها reasoning وسيط حقيقي — ألغاز multi-step، توليد كود محتاج state-tracking دقيق، مسائل math word بحسابات فرعية كتيرة، مهام planning الإجابة فيها بتعتمد على chain طويلة من "لو X يبقى Y". الدرسين الجايين هيشغّلوا لغز منطقي عبر النماذج الأساسية التلاتة عشان تشوف "من غير تفكير" شكلها إيه، وبعدين نقارن بتكلفة إنك تطلع لـthinking mode.

التالي: لغز منطقي عبر النماذج الأساسية التلاتة، من غير تفعيل thinking. الفجوة في المخرج أوسع من اللي إنت متوقّعه. :::

اختبار

الوحدة 4: أوضاع التفكير — متى تفكر، ومتى تتخطى

خذ الاختبار
هل كان هذا الدرس مفيدًا؟

سجّل الدخول للتقييم