زلزال OpenAI الجديد.. نموذج o3 الخارق يتفوق على ذكاء البشر ومكتسح عالم البرمجة!

Deve-PoinT

Administrative
طاقم الإدارة
مــدير عـــام
11 يوليو 2022
793
8
67
28
Egypt
يا هلا بوجوه الخير وأعضاء ديف بوينت الكرام! سنة 2024 كانت مليانة مفاجآت في عالم الذكاء الاصطناعي، وبدل ما تخلص هادية، حبت OpenAI تولع المنافسة من تاني في اللحظات الأخيرة. في الوقت اللي الكل افتكر إن جوجل بدأت تسحب البساط وتتفوق، نزلت OpenAI بالضربة القاضية وأعلنت عن نموذجها الجديد o3.

النموذج ده مش مجرد تحديث عادي، ده نقلة نوعية حقيقية في قدرة الذكاء الاصطناعي على "التفكير والتحليل المنطقي". تعالوا مع بعض في الموضوع ده نفهم إيه الحكاية وليه النموذج ده قالب الدنيا!

إيه هو نموذج o3 وليه عامل الضجة دي كلها؟

النموذج الجديد o3 ومعاه النسخة المصغرة o3-mini جم عشان يكسروا الأرقام القياسية اللي عملها النموذج السابق o1. الميزة الأساسية هنا هي قدرة النموذج على "التفكير العميق" (Deep Reasoning).

النموذج ده مش بيجاوب بسرعة وخلاص؛ لأ، ده بياخد وقته في التفكير وتحليل السؤال من كل الجوانب عشان يوصل لأدق إجابة ممكنة. وبكده بيحل المشكلة الأزلية في النماذج القديمة اللي كانت بتعتمد بس على كثرة البيانات وقوة المعالجة بدون فهم حقيقي.

اختبار ARC-AGI: لما الذكاء الاصطناعي يقرب من ذكاء البشر

عشان نفهم العبقرية دي بالأرقام، فيه اختبار شهير اسمه ARC-AGI. ده اختبار بيقيس قدرة الذكاء الاصطناعي على حل مسائل معقدة ومبتكرة محتاجة تفكير منطقي عام، مش مجرد تكرار لحاجات اتدرب عليها قبل كده. الاختبار ده بيعتبر "سهل للبشر، وصعب جداً على الآلات".

شوفوا بقى التطور الرهيب لنسب نجاح عائلة نماذج GPT في الاختبار ده:

  • GPT-2 (2019): حقق نسبة 0% (مكانش فيه أمل).
  • GPT-3 (2020): حقق نسبة 0% برضه.
  • GPT-4 (2023): حقق نسبة 2% (بداية الغيث قطرة).
  • GPT-4o (2024): حقق نسبة 5%.
  • o1-preview (2024): قفز لـ 21%.
  • o1 high (2024): وصل لـ 32%.
  • o1 Pro (2024): وصل لـ 50% تقريباً.
  • o3 (2024): طار لـ 76%!
  • o3 [وضع الحوسبة العالية] (2024): حقق رقم مرعب وهو 87%!

من فضلك قم , تسجيل الدخول أو تسجيل لعرض المحتوى

المبرمجين في خطر؟ أداء o3 المرعب في البرمجة

إدارة OpenAI صرحت علناً وقالت: "النموذج ده خارق في البرمجة بشكل لا يصدق".

وعشان نثبت ده بالأرقام، في منصة Codeforces الشهيرة للبرمجة التنافسية (اللي بيستخدمها أقوى مبرمجي العالم عشان يثبتوا مهاراتهم ويحلوا أصعب المسائل البرمجية)، نموذج o3 قدر يحقق تصنيف يخليه في المركز 175 على مستوى العالم بين المبرمجين البشر! يعني إحنا مش بنتكلم عن مساعد كود بيكتب تاجات بسيطة، ده بقى منافس حقيقي في كتابة الأكواد وحل الخوارزميات المعقدة.

الجانب المظلم: تكلفة تشغيل مرعبة!

طبعاً الطفرة دي مش بلاش. الخبراء والمطورين وضحوا إن تشغيل o3 في وضع الأداء العالي بيستهلك طاقة معالجة وحوسبة بتوصل لـ 172 ضعف مقارنة بالوضع العادي!

وده معناه تكلفة مادية ضخمة جداً. بعض المتخصصين قدروا إن تكلفة حل مسألة واحدة معقدة جداً في وضع الحوسبة العالية ممكن يوصل لـ "آلاف الدولارات" للمسألة الواحدة!

من فضلك قم , تسجيل الدخول أو تسجيل لعرض المحتوى

سؤال جانبي: هي فين "o2" وليه نطوا لـ o3 على طول؟

في المؤتمر التقديمي، تم الكشف عن سبب تخطي اسم "o2" تماماً؛ والسبب ببساطة هو تجنب أي مشاكل قانونية أو تداخل أسماء مع شركة الاتصالات الشهيرة O2 (الفرع البريطاني لمجموعة تليفونيكا). حركة ذكية لتفادي الصداع القضائي!

خاتمة ونقاش

من الواضح كده إننا داخلين على عصر جديد تماماً في الذكاء الاصطناعي، والسرعة اللي بتتحرك بيها التكنولوجيا دي بقت مرعبة ومثيرة في نفس الوقت.

إيه رأيكم يا شباب ديف بوينت في التطور ده؟ تفتكروا نماذج التفكير العميق دي زي o3 ممكن تغير شكل البرمجة وتطوير البرمجيات بالكامل في السنين الجاية؟ وهل التكلفة العالية دي هتفضل عائق قدام انتشارها؟

شاركونا بآرائكم وتوقعاتكم في التعليقات!
 

AdBlock Detected

We apologize, but you must disable AdBlock to view this site.

We rely on advertisements to support the continuity of the site and provide the best content.