Treechat
القائمة
جرّبه مجانًا
كل الملاحظات

ما مقدار الطاقة التي يقوم بها أ ChatGPT استخدام الاستعلام؟

الإجابة الصادقة هي نطاق، وليس رقمًا واحدًا. فهنا ما هو عام، وما هو مقدر، وما تم إغفاله.

بقلم Treechat6 دقيقة قراءة
يمر شريط موجه واحد عبر المعالج ومقياس الطاقة الفعلي.

الإجابة المختصرة هي أن الاستعلام النصي العادي ربما يستخدم جزءًا من الواط/ساعة، لكن لا يوجد إجابة عالمية "ChatGPT الاستعلام". إن طلب إصلاح جملة ومهمة البحث العميق التي تقرأ عشرات المصادر هي وظائف حوسبة مختلفة. إن التعامل معها على أنها قابلة للتبديل يجعل أي شكل ذو مظهر دقيق أقل فائدة مما يبدو.

وهذا لا يعني أننا لا نعرف شيئا. في عام 2025، OpenAI كتب الرئيس التنفيذي سام التمان أن المتوسط ChatGPT يستخدم الاستعلام حول 0.34 واط/ساعة. في نفس الوقت تقريبًا، قدر الباحثون المستقلون في Epoch AI تقديرًا تقريبيًا 0.3 واط/ساعة للنموذجي GPT-4o الاستعلام. إن الاتفاقية جديرة بالملاحظة، ولكنها ليست مثل القياس العام المدقق بشكل مستقل. لم ينشر ألتمان الحساب وراء رقمه، بينما كان على إيبوك أن يضع افتراضات حول النموذج والأجهزة والاستخدام وعدد الرموز المميزة.

لذا فإن 0.3–0.34 Wh هي نقطة مرجعية مفيدة لتبادل نص عادي من النوع الذي تصفه تلك التقديرات. إنها ليست قراءة عداد لموجهك الخاص، ولا ينبغي أن تمتد لتشمل كل وضع أو نموذج.

لماذا يمكن أن يكون استعلام واحد مختلفًا تمامًا عن الآخر

يتم إنشاء استجابة الذكاء الاصطناعي رمزًا مميزًا. بشكل عام، المزيد من المدخلات للمعالجة والمزيد من المخرجات لتوليد المزيد من العمل. قد تنتهي الإجابة الواقعية القصيرة بسرعة. محادثة طويلة تحمل السياق السابق إلى الأمام. يؤدي تحميل مستند كبير إلى إضافة تكلفة معالجة مسبقة. قد يقوم نموذج الاستدلال بإنشاء رموز عمل مخفية قبل أن يظهر إجابة. يمكن لأدوات البحث وتوليد الصور والأدوات الوكيلة استدعاء عدة أنظمة بدلاً من نظام واحد.

توضح الأمثلة العملية لـ Epoch حجم هذا الاختلاف. وضع نموذجها استعلامًا بإدخال 10,000 رمز مميز تقريبًا 2.5 وات في الساعة وواحدة بمدخل 100,000 رمز بالقرب من 40 وات في الساعة، في ظل افتراضاتها المعلنة. هذه ليست تقديرات للدردشة المتوسطة. إنها توضح سبب كون كلمة "استعلام" فظة جدًا في حد ذاتها.

النموذج مهم أيضا. يقوم النموذج الأصغر بشكل عام بإجراء عمليات حسابية أقل لكل رمز مميز تم إنشاؤه مقارنة بالنموذج الكبير، على الرغم من أن الهندسة المعمارية والقياس الكمي وتحسين الأجهزة والبرامج تزيد من تعقيد المقارنة. تعمل نماذج خليط الخبراء على تنشيط جزء فقط من إجمالي عدد المعلمات لكل رمز مميز. يمكن للمسرعات الحديثة أن تقوم بالمزيد من العمل لكل وحدة كهرباء مقارنة بالأجهزة القديمة. يتيح التجميع الفعال لخادم واحد التعامل مع العديد من المستخدمين معًا، ولكن قد يكون الخادم الفارغ أو المستخدم بشكل خفيف أقل كفاءة لكل إجابة.

ثم هناك مركز البيانات حول الرقائق. يستهلك التبريد والشبكات وتحويل الطاقة الكهرباء أيضًا. عادة ما يقوم الباحثون بحساب هذه النفقات العامة من خلال عامل فعالية استخدام الطاقة. وتعتمد النتيجة أيضًا على مكان وزمان توليد الكهرباء: فالواط/ساعة لديها نفس الطاقة في كل مكان، ولكن الانبعاثات المرتبطة بها تختلف باختلاف مزيج الشبكة.

ما الذي يتم حسابه فعليًا؟

تصف معظم الأرقام لكل استعلام الكهرباء التشغيلية للاستدلال: الطاقة المستخدمة أثناء تقديم الخدمة للإجابة، بالإضافة إلى بعض المخصصات للنفقات العامة لمركز البيانات. ولا يجوز أن تشمل هاتف المستخدم أو الكمبيوتر المحمول، أو النقل عبر الشبكة، أو التخزين، أو التدريب النموذجي، أو تصنيع الرقائق والمباني، أو البنية التحتية التي تظل جاهزة بين الطلبات.

لا يوجد حد واحد صحيح لكل سؤال. إذا كنت تقارن بين خيارين للاستدلال، فإن الطاقة التشغيلية لكل استجابة تكون مفيدة. إذا كنت تقوم بإعداد جرد الكربون على مستوى الشركة، فقد يكون وضع حدود أوسع لدورة الحياة أكثر ملاءمة. تبدأ المشاكل عندما يتم تقديم تقدير ضيق على أنه التكلفة البيئية الكاملة - أو عندما تتم مقارنة تقدير واسع بتقدير ضيق.

التدريب يستحق معاملة منفصلة. إنها مهمة عرضية كبيرة يمكن توزيع تأثيرها على عدد غير معروف من الاستخدامات المستقبلية. قم بتقسيمها على عدد أكبر من الرسائل وتقلص حصتها لكل رسالة؛ تتضمن نموذجًا يتم استبداله بسرعة ويرتفع. يمكن أن يساعد التخصيص في المحاسبة، ولكنه لا يتم سحب الكهرباء في اللحظة التي تضغط فيها على إرسال.

وينطبق نفس الحذر على الماء والكربون. ويعتمد استخدام المياه على تكنولوجيا التبريد وسلسلة إمداد الكهرباء. يعتمد الكربون على الموقع والتوقيت وما إذا كانت المحاسبة تستخدم مزيج الشبكة المادية أو المشتريات التعاقدية للطاقة المتجددة. إن تحويل Wh إلى جرامات من الكربون دون تحديد تلك الاختيارات يخفي قدرًا كبيرًا من عدم اليقين.

كيف سافر الرقم القديم 3 واط

لعدة سنوات، غالبًا ما قيل في المقالات أ ChatGPT الطلب المستخدم حول 3 اه, يقترن أحيانًا بالادعاء بأن هذا كان عشر مرات أ Google يبحث. جاء هذا الرقم من تقدير مبكر باستخدام أجهزة A100 الأقدم، أ GPT-3.5-scale نموذج ومفترض 2,000 رموز الإخراج. يشرح عصر الذكاء الاصطناعي سبب اعتباره تلك الافتراضات غير ممثلة للاستخدام الحديث النموذجي في حد ذاته المنهجية والمقارنة.

يعد تحديث التقدير عند تغيير الأجهزة والخدمات ممارسة جيدة. وهذا لا يثبت أن استخدام طاقة الذكاء الاصطناعي غير ذي صلة. وهذا يعني أن رقمًا شائعًا لكل استعلام قديم بشكل سيء.

المقارنة مع بحث الويب هشة لسبب آخر: مصدر رقم البحث المقتبس بشكل شائع Google في عام 2009. يتضمن البحث الآن بنية تحتية مختلفة ويتضمن أحيانًا ملخصات تم إنشاؤها. يؤدي وضع تقدير حديث للذكاء الاصطناعي بجانب تقدير بحث قديم إلى إنشاء نسبة بسيطة على ما يبدو من قياسات مختلفة.

كيف يتم إساءة استخدام الأرقام في كلا الاتجاهين

أحد أشكال إساءة الاستخدام هو أخذ تقديرات عالية الجودة أو قديمة، وضربها بعدد كبير من الطلبات المتخيلة، وتقديم النتيجة كإجمالي مقاس. يمكن أن يؤدي ذلك إلى المبالغة في استخدام النص العادي وصرف الانتباه عن أعباء العمل الأكثر كثافة حقًا.

سوء الاستخدام المعاكس يبدأ بمتوسط منخفض وينتهي بأنه لا يوجد شيء يجب مراعاته. ولا تزال كمية صغيرة مضروبة في الاستخدام الكبير والمتزايد تمثل طلبًا على النظام. ال عمل وكالة الطاقة الدولية في مجال الطاقة والذكاء الاصطناعي ينظر إلى الطلب في مركز البيانات على مستوى النظام هذا. يمكن أن تكون كفاءة كل استعلام ونمو إجمالي الكهرباء صحيحين عندما يتوسع الاستخدام وتتطلب المهام الجديدة مزيدًا من الحوسبة.

خطأ آخر هو الدقة الزائفة. يتم قياس "0.34 Wh" بمنزلتين عشريتين، لكن البيان العام يصف متوسطًا عبر مزيج غير معلن من الطلبات. إن الاحتفاظ بالسياق وعدم اليقين أكثر صدقًا من تحويله إلى ثابت عالمي.

كيف Treechat يقدر رسالة

Treechat لا يمكن قراءة عداد الطاقة المرفق بكل استجابة. لا يكشف مقدمو الخدمة عن هذا القياس. نحن نقدر بدلاً من ذلك، ونصنف النتيجة كتقدير.

تبدأ حساباتنا بالنموذج المستخدم ومعالجة الرموز المميزة وإنشائها. وهي تطبق منهجية الطاقة العامة القائمة على النموذج، وتضيف النفقات العامة لمركز البيانات، وتحول الكهرباء إلى انبعاثات مقدرة باستخدام متوسط ​​كثافة الكربون في الشبكة. الافتراضات والثوابت الحالية مبينة على موقعنا صفحة المنهجية.

نقوم بتوجيه الطلبات اليومية إلى نموذج أصغر افتراضيًا لأن اختيار النموذج هو إحدى الرافعات التي يمكننا سحبها فعليًا. نعرض أيضًا إيصالًا تقديريًا للإجابة بدلاً من المطالبة بقياس دقيق. عندما تكون الأدلة غير كاملة، فإننا ندور ضد أنفسنا. نحن نفضل التقليل من المطالبة بالادخار بدلاً من تقديم وعد واضح لا يمكن للبيانات الأساسية دعمه.

الإجابة الأكثر دفاعًا إذن ليست "أ". ChatGPT "يستخدم الاستعلام X بالضبط. إنه: يبدو أن الاستعلامات النصية العادية تجلس حول جزء صغير من واط ساعة وفقًا للتقديرات العامة الأخيرة، في حين أن السياق الطويل والتفكير والعمل الثقيل بالأدوات يمكن أن يستخدم أكثر من ذلك بكثير. اسأل عن النموذج، وكم عدد الرموز المميزة، وما هي الأجهزة وأي حدود. وبدون هذه التفاصيل، يكون الرقم بمثابة علامة، وليس حقيقة حول كل استعلام.