Treechat
القائمة
جرّبه مجانًا
كل الملاحظات

هل قول شكرًا للذكاء الاصطناعي يكلف طاقة؟

نعم: إرسال رسالة شكر يؤدي إلى استنتاج آخر. التكلفة عادة ما تكون صغيرة، والمجاملة ليست مشكلة الطاقة الرئيسية للذكاء الاصطناعي.

بقلم Treechat5 دقيقة قراءة
تنتقل نبضة سريعة رئيسية ونبضة ترحيب أصغر عبر نفس المعالج.

نعم. إذا أرسلت "شكرًا" كرسالة جديدة تعمل بالذكاء الاصطناعي، فستقوم الخدمة بمعالجة المحادثة وإنشاء استجابة أخرى، وبالتالي تستخدم بعض الكهرباء الإضافية. بالنسبة لتبادل الرسائل النصية القصيرة العادية، تشير أفضل التقديرات العامة إلى أن التكلفة من المحتمل أن تكون جزءًا صغيرًا من الواط/ساعة، على الرغم من عدم وجود رقم عالمي ينطبق على كل نموذج وخدمة.

هذه طاقة حقيقية، لكنها ليست سببًا مفيدًا للشعور بالذنب تجاه المجاملة الأساسية. يمكن للمخرجات الطويلة، ونوافذ السياق الضخمة، والأجيال المتكررة، وإنشاء الصور والفيديو، والوكلاء الثقيلين للأدوات، واختيار توجيه كل مهمة إلى نموذج كبير أن تحدث اختلافات أكبر بكثير. إذا كان قول شكرًا لك يجعل التفاعل يبدو طبيعيًا، فإن الإجابة المسؤولة هي المنظور، وليس حملة ضد كلمتين مهذبتين.

ماذا يحدث بعد الضغط على إرسال

لا يشعر الذكاء الاصطناعي بالامتنان، لكن نظام الحوسبة لا يزال يتعامل مع كلمة "شكرًا" على أنها طلب. فهو يحزم النص الجديد مع تعليمات النظام وبعض محفوظات المحادثة، ويرسل هذا الإدخال إلى نموذج، ويولد ردًا مثل "على الرحب والسعة".

تنتج نماذج اللغة رمز الرد هذا برمز مميز. يساعد الإخراج القصير في إبقاء المهمة صغيرة، ولكن يمكن أن يتضمن الإدخال أكثر من العبارة المرئية. في محادثة طويلة، قد تقوم الخدمة بمعالجة سياق كبير مرة أخرى. يمكن للموفرين تخزين أجزاء من الموجه المتكرر مؤقتًا، على الرغم من أن تأثير الطاقة يعتمد على التنفيذ.

وبالتالي فإن التكلفة الحدية ليست مجرد كهرباء لكلمتين مدخلتين. إنها تكلفة استنتاج آخر حول أي سياق يوفره النظام بالفعل.

ما مقدار الطاقة تلك؟

OpenAI قال الرئيس التنفيذي سام التمان في المتوسط ChatGPT يستخدم الاستعلام حول 0.34 واط/ساعة. تم تقدير حقبة الذكاء الاصطناعي بشكل مستقل حولها 0.3 واط للنموذجي GPT-4o الاستعلام، في ظل افتراضاتها حول الرموز والأجهزة والاستخدام.

قد يكون الشكر المختصر والرد المختصر أقل من متوسط الخدمة العامة، ولكن لا يوجد قياس عام كافٍ لتخصيصه رقمًا جديرًا بالثقة. قد يكون النموذج أصغر أو أكبر؛ يمكن أن تكون المحادثة قصيرة أو ضخمة. يمكن استخدام مركز البيانات بشكل جيد أم لا.

شرحنا ل تكلفة الطاقة لرسالة الذكاء الاصطناعي الواحدة يوضح سبب كون نوع الطلب أكثر فائدة من كلمة "رسالة" وحدها.

المجاملة ليست الرافعة الكبيرة

يمكن للمناقشة البيئية أن تركز بشكل غريب على آداب السلوك الفردية لأنها واضحة وسهلة الوعظ بها. أما البنية التحتية وتصميم المنتجات فهي أقل وضوحا ولكنها أكثر أهمية: النموذج الذي تم اختياره، ومدة تشغيله، ومدى كفاءة تقديمه، وما إذا كانت نقرة واحدة تبدأ سلسلة من المكالمات.

الوكالة الدولية للطاقة تقرير الطاقة والذكاء الاصطناعي تتوقع نموًا قويًا في استخدام الكهرباء في مراكز البيانات، مدفوعًا بشكل أساسي بالذكاء الاصطناعي بالإضافة إلى الخدمات الرقمية الأخرى. لن يتم حل هذه المشكلة على مستوى النظام عن طريق جعل المستخدمين ينهون المحادثات فجأة.

يمكن للخدمات أن تحدث فرقًا أكبر من خلال تعيين العمل الروتيني على نماذج صغيرة قادرة، والحد من عمليات إعادة المحاولة المهدرة ومنح الأشخاص تحكمًا معقولاً في المخرجات والأدوات.

يستخدم الأشخاص واجهات المحادثة اجتماعيًا وكذلك بشكل فعال. يمكن للأدب أن يحافظ على عادة الكتابة، أو يساعد الأطفال على ممارسة التواصل المحترم، أو ببساطة يجعل استخدام البرامج أقل إزعاجًا. يمكن أن توضح المتابعة المهذبة أيضًا أن المهمة قد انتهت، وهو ما قد يكون مهمًا في سير العمل متعدد الخطوات.

ليست هناك حاجة للتظاهر بأن تلك الفوائد تجعل الكهرباء تختفي. النقطة هي التناسب. إننا ننفق بشكل روتيني قدرًا صغيرًا من الطاقة على تعليقات الواجهة لأنها تساعد الأشخاص على فهم النظام والثقة فيه. الهدف البيئي ليس التفاعل الرقمي الصفري؛ إنه عمل مفيد يتم تقديمه وبتأثير أقل يمكن تجنبه.

هذا التمييز مهم أيضًا في المناقشات حول مقدار الكهرباء التي يستخدمها الذكاء الاصطناعي: هناك علاقة بين الرسائل الشخصية وإجمالي الطلب على البنية التحتية، ولكنها ليست نفس مسألة السياسة.

طرق أفضل لتقليل أعمال الذكاء الاصطناعي غير الضرورية

إذا كنت ترغب في تقليل الطاقة دون ضبط الأخلاق، فاجمع التعليمات ذات الصلة في مطالبة واحدة واضحة. اسأل عن طول الإخراج الذي تحتاجه بالفعل. أوقفوا جيلاً يسير في الاتجاه الخاطئ. استخدم البحث أو الآلة الحاسبة أو البرامج العادية عندما لا يضيف التوليد أي شيء. اختر نموذجًا أصغر حجمًا للعمل المباشر.

تجنب لصق مستند بأكمله عندما يكون أحد الأقسام ذا صلة، وابدأ محادثة جديدة عندما لا يعود السياق القديم مفيدًا. بالنسبة للعمل المعقد، يمكن أن يؤدي تخطيط الطلب إلى منع عدة أجيال فاشلة. لا ينبغي لأي من هذه الأمور أن تصبح اختبارًا للنقاء؛ إنها ببساطة طرق لمواءمة الحساب مع القيمة.

ويوضح نفس المبدأ لماذا تستخدم نماذج الذكاء الاصطناعي الأصغر طاقة أقل في كثير من الأحيان: تقليل العمل يكون أكثر أهمية عندما تكون النتيجة تلبي الحاجة.

ماذا عن ملايين الشكر؟

أي عمل صغير يمكن أن يصبح ماديًا على نطاق واسع جدًا. لكن ضرب متوسط ​​غير مؤكد لكل رسالة بعدد عالمي متخيل لا يؤدي إلى إنشاء إحصائية قابلة للقياس. ليس لدينا بيانات عامة عن عدد الرسائل التي تعتبر مجاملة خالصة، أو النماذج التي تجيب عليها، أو حجم السياق الذي تحمله.

تعد التأثيرات المجمعة سببًا لمقدمي الخدمات لتحسين الإقرارات القصيرة، ربما باستخدام النماذج الأصغر أو الاستجابات المخزنة مؤقتًا أو سلوك الواجهة المحلية. فهي ليست أساسًا سليمًا لفضح مستخدم فردي. يتحكم تصميم الخدمة المنتشرة على نطاق واسع في التكلفة الافتراضية عبر كل تفاعل.

ومن المفيد أن نتساءل عما إذا كان النظام يستخدم مسار استجابة بحجم مناسب بدلاً من أن نتساءل عما إذا كان شخص واحد مهذبًا للغاية.

كيف Treechat يعامل الرسالة الإضافية

Treechat يحسب رسالة الشكر المرسلة مثل أي تبادل مساعد آخر ويعرض إيصال التأثير المقدر على الإجابة. يستخدم التقدير أعداد النماذج والرموز المميزة، ويضيف النفقات العامة المحددة لمركز البيانات ويطبق افتراض الشبكة المنشور. إنه ليس قياسًا مباشرًا. الحساب وحدوده متاح في /methodology.

إذا كنت تريد أن تقول شكرا لك، قل ذلك. إنها تكلف القليل من الطاقة بسبب حدوث استنتاج آخر. ثم ضع المقياس في الاعتبار: إن اختيار النماذج المتناسبة وتجنب العمل عالي الحوسبة غير الضروري حقًا هما أدوات أفضل من تجريد الدفء البشري العادي من المحادثة.

هل قول شكرًا للذكاء الاصطناعي يكلف طاقة؟ · Treechat blog