أكبر ليست دائما أفضل في عالم الذكاء الاصطناعي

يمكنك الدوار إذا حاولت احتواء إعلانات Openai الأسبوع الماضي. تقوم الشركة التي تقف وراء ChatGPT ببناء في تكساس مقابل 850 مليار دولار في مراكز البيانات الجديدة ، والتي ستستخدم أكبر قدر من الطاقة التي تنتج سبعة عشر محطات للطاقة النووية. الرئيس التنفيذي لشركة Openai Sam Altman يحسب التكاليف في تريليون – المليارات – سوف تمشي.
هذه الاستثمارات الضخمة في يجب أن توفر سعة ChatGPT قوة حوسبة للتوصل إلى المزيد والمزيد من المستخدمين لمزيد من المستخدمين (يوجد الآن 700 مليون). لتدريب نماذج AI الجديدة ، تحتاج إلى أحدث رقائق ، وكلما تم استجواب نماذج AI أكثر كثافة ، كلما كانت مراكز البيانات مطلوبة لتقديم الإجابات.
إن الرمي مع Gigawatts و مليارات المليارات هو جزء من الولايات المتحدة ، لأنه مع هذه الأرقام تنقذ الرئيس الأمريكي. كان دونالد ترامب مسرورًا عندما أعلن مشروع ستارغيت في يناير ، حيث تم تعميد مشروع مركز بيانات تكساس. مع هذا الحاسوب الخارق الكبير ، تأمل أمريكا في الفوز بسباق الذكاء الاصطناعى مع الصين ، في طريقها إلى Agi ، الذكاء العام الاصطناعي الذي يمكن لكل شخص ، حتى الرئيس ، مسؤولاً فكريًا.
البناء غريب
يريد سام التمان التخلص من مقرضه الأول ، مايكروسوفت. اختار البناء المالي الجريء مع NVIDIA (مصمم الرقائق) ، Oracle (Cloud and Data Center Services) و Openai (AI Developer).
والنتيجة هي علاقة مثلثية غريبة: Nvidia العصي ، في خطوات من 10 مليارات ، 100 مليار دولار في Openai ، يوقع Openai عقد 300 مليار مع Oracle ، و Oracle طلبات 40 مليار دولار إلى رقائق Nvidia. ليس من الواضح أين ينتهي جيب واحد ويبدأ الشخص الآخر الآخر.
لا يتوقع Openai أن يكون مربحًا في عام 2029. في غضون ذلك ، تواصل الشركة حرق الأموال للحفاظ على عمل ChatGPT والبقاء في صدارة المنافسة من Google و Meta و Microsoft و Nothropic. طالما أن المستثمرين يثقون في أن Openai سوف يكسب المال من خلال الخدمات المدفوعة والإعلانات وأدوات الذكاء الاصطناعى ، فإن البناء لا ينهار. لكنه لا يزال هش.
الرغبة في الكبير
يدور AI-Haussse حول نماذج اللغة الكبيرة ، وكميات كبيرة من تواريخ التدريب ، ومراكز بيانات كبيرة وكميات كبيرة. مقارنة بخدمات الويب الأخرى ، فإن اقتصادات الحجم في الذكاء الاصطناعى محدودة. قم بتشغيل المزيد من المستخدمين الذين يطرحون أسئلة أكثر تعقيدًا وأيضًا هناك الوكلاء -نماذج أخرى من الذكاء الاصطناعى-عند إشراكها ، يتطلب ذلك حقًا قوة حوسبة أكثر تكلفة.
عشاق السيارات الأمريكيين لديهم تعبير عن هذا: لا يوجد شيء مثل سنتيمتر مكعب – تحتاج إلى أسطوانات كبيرة لتقديم الطاقة الكافية. في غضون ذلك ، فإن أسرع السيارات لم تعد تحتوي على أسطوانات: فهي كهربائية وتأتي من الصين.
يصل حجم نماذج الذكاء الاصطناعى الحالية أيضًا إلى حد. على سبيل المثال ، GTP5 ، النموذج الجديد وراء ChatGPT ، لا يجيب ثوري أفضل من الإصدارات السابقة. يبدو أن التحديث يهدف أيضًا إلى الحفاظ على التكاليف قيد السيطرة.
بالنسبة للمستخدم العادي ، يبدو أن Chatgpt مثل ألف ملابس تستخدمها في كل شيء. في الواقع ، بالنسبة لبعض الأسئلة ، يكتشف النموذج أولاً ما إذا كان يمكن استدعاء خبير أصغر وأفضل مناسبة. وهذا يوفر الحسابات ، لذلك المال.
الكفاءة على الصينية
أفضل مثال معروف لمثل هذا النهج الفعال يأتي من الصين. يتم تدريب Deepseek ، الذي تم تقديمه في يناير من هذا العام ، المستهلكة مع المنافسين الأمريكيين الأقل حوسبة ، على بيانات قليلة نسبيًا ولا يزال بإمكانهم إنشاء إجابات ذكية.
من خلال العمل مع الخليط أو الخبراء ، كما تسمى الطريقة ، لا يستخدم DeepSeek لكل سؤال سوى جزء صغير من أكثر من 600 مليار معلمة يضمها النموذج. يقول مارتين جروتندوست: “كان Deepseek-R1 أول نموذج مفتوح المصدر استخدم مزيجًا من الخبراء على نطاق واسع وكان جيدًا مثل ChatGpt”. وهو خبير هولندي من الذكاء الاصطناعى كتب عملًا قياسيًا لخبراء الذكاء الاصطناعي مع جاي ألامار ، نماذج اللغة الكبيرة. إنه كتيب لمبرمجي الذكاء الاصطناعى ، مع الرسوم البيانية التي يتم ترحيلها جيدًا بدلاً من الصيغ الرياضية. هذه الصيغ تجعل الأمور معقدة بشكل غير ضروري ، وفقًا لـ Groutendorst. يحب أن يشرح عالم الذكاء الاصطناعي بلغة مفهومة ، مع العديد من الصور.
على سبيل المثال ، تعلم ، أخصائي علم النفس ، لفهم التكنولوجيا بنفسه عندما بدأ العمل في مركز السرطان المتكامل Nederland. تعمل Grootendorst على طريقة آمنة لتدريب نماذج الذكاء الاصطناعي مع بيانات المريض من جميع المستشفيات. يقود حياته المزدوجة كداعية دولية من الذكاء الاصطناعى من حي جديد في تيلبورغ.
يغير صعود نماذج المصدر المفتوح ، مثل Deepseek و Qwen (من Alibaba) ، عملها: يمكنك تنزيل الكود ، والعبث به وحتى تعطيل آليات الرقابة المدمجة.
حكاية خيالية علمية
هذه النماذج اللغوية الرائعة أو LLMs مفيدة جدًا ، يوضح Grootendorst خلف جهاز الكمبيوتر الخاص به. يزين جهاز الكمبيوتر الذي يحتوي على غطاء شفاف للمكتب ، حيث تقوم بطاقة فيديو NVIDIA التي تضم ألف يورو بعمل الحساب. حتى أن أصغر النماذج تعمل على هاتفه ، في عام 2021.
الذكاء الاصطناعي هو عن التسويق. ترغب الشركات في الشاشة مع عدد كبير من الكلمات أو الرموز التي يمكنك إدخالها. يقول جروتندورست: “في بعض الأحيان مليون”. “لكن يجب على النموذج بعد ذلك معالجة كمية مجنونة من المعلومات التي لم تعد تعمل بشكل جيد.”
ووفقا له ، فإن نماذج لغة التفكير so so هي أيضا اختلافات في نفس الموضوع. “إنهم يستخدمون المزيد من الوقت للتفكير بصوت عالٍ قبل الإجابة ، لكنه ليس أكثر من خدعة.”
يرى Grootendorst انشقاقًا في عالم الذكاء الاصطناعي: يبدو كما لو أن وادي السيليكون بدأ يؤمن بقصصه الخيالية الخيالية العلمية مع البحث عن AGI ، في حين أن المطورين الصينيين براغماتية للغاية. إنهم يكافحون مع قيود التصدير مع عدم وجود رقائق AI سريعة ، بحيث يطورون نماذج مفيدة يمكنها القيام بهذه المهمة بسهولة.
ميزة إضافية لنماذج المصادر الصينية المفتوحة: تجذب العلماء الذين يرغبون في أن يكونوا قادرين على نشر عملهم. هناك حاجة إلى معرفتهم للابتكار بشكل أسرع ، وهذا هو السبب في أن عمالقة الذكاء الاصطناعى الأمريكيين تبدأ أيضًا بمشاريع أكثر مفتوحة المصدر. لم يعد البحث يركز على أرقام أكثر إثارة للدهشة ، ولكن على التخصص والكفاءة. Grootendorst: “الكل يريد نموذجًا رخيصًا سريعًا وجيدًا. أصغر أفضل.”
جديد: أعط هذا المقال كهدية
كمشترك في NRC يمكنك القيام به كل شهر 10 مقالات أعط هدية لشخص دون اشتراك NRC. يمكن للمستلم قراءة المقالة مباشرة ، دون جدار الدفع.



