نتائج البحث عن "GPT"
2026-06-17 09:47

يتصدر نموذج GLM-5.2 لدى Zhipu نماذج المصدر المفتوح الأعلى في معيار AA مسجلاً 51 نقطة، ويتطابق مع GPT-5.5 في اختبار GDPval

تبعًا لمراقبة Beating AI، يتصدر أحدث نموذج GLM-5.2 من Zhipu قائمة النماذج مفتوحة المصدر في اختبار الذكاء التابع لـ Artificial Analysis v4.1، محققًا 51 نقطة، متجاوزًا MiniMax-M3 (44 نقطة) وDeepSeek V4 Pro (44 نقطة). وفي اختبار GDPval-AA v2 الذي يحاكي أعمال المعرفة في العالم الحقيقي، حقق GLM-5.2 1,524 نقطة (الحدّ البشري الأساسي: 1,000)، متطابقًا مع نموذج GPT-5.5 من الفئة الاحتكارية في وضع التفكير xhigh، ومتفوّقًا على MiniMax-M3 (1,418 نقطة) وDeepSeek V4 Pro (1,328 نقطة). يضم النموذج 744B من إجمالي
المزيد
2026-06-16 10:25

تكلفة كلود أوبس 4.8 أعلى بـ 44 مرة من تكلفة DeepSeek V4 Pro، وتكشف أحدث تقييمات التحليل الاصطناعي عن ذلك

وفقاً لـ Artificial Analysis، في أحدث تقييم للذكاء الاصطناعي، سجل Claude Opus 4.8 56 نقطة بتكلفة 1.78 دولار لكل مهمة، بينما سجل DeepSeek V4 Pro 44 نقطة بتكلفة 0.04 دولار فقط لكل مهمة—ما يجعل Claude أغلى بـ 44 مرة. وقد قامت عملية التقييم بتحديث معاييرها لقياس القدرات الواقعية، بما في ذلك التخطيط واستخدام الأدوات وتنفيذ المهام المعقدة، واستبدلت الاختبارات المبسطة متعددة الاختيارات. تصدّر Claude Opus 4.8 النماذج المتاحة، تلاه GPT-5.5 بـ 55 نقطة. وحققت نماذج محلية أخرى أداءً منافساً، إذ وصلت MiniMax
المزيد
2026-06-16 06:17

تعتزم OpenAI إطلاق GPT-5.6 في 23 يونيو بسياق رمزي 1.5 مليون، وبسعر يعادل ثلث ما يقدَّم به Claude Fable 5

بحسب مراقبة Beating، ستطلق OpenAI GPT-5.6 في 23 يونيو، مع نافذة سياق بسعة 1.5 مليون رمز، وتسعير واجهة برمجة التطبيقات بسعر يعادل ثلث معدل Anthropic الخاص بـ Claude Fable 5. ويتزامن ذلك مع إطلاق Anthropic لـ Claude Fable 5 في 9 يونيو، وإزالته لاحقاً من قبل وزارة التجارة الأمريكية في 12 يونيو بسبب ثغرات أمنية. تسعّر أسواق التنبؤ حالياً احتمال صدور GPT-5.6 بين 22 و28 يونيو عند 78 بالمئة.
المزيد
2026-06-13 13:29

تتعاون شركة BBVA مع OpenAI لنشر ChatGPT Enterprise، ويُنشئ الموظفون أكثر من 20,000 من نماذج GPT المخصصة

بحسب PANews، أعلنت BBVA في 13 يونيو شراكة استراتيجية مع OpenAI لدمج الذكاء الاصطناعي في خدمة العملاء، وعمليات الأعمال، وتطوير البرمجيات، وسير عمل الموظفين. ويهدف مجموعة الخدمات المصرفية الإسبانية إلى التحول إلى نموذج تشغيل أصيل في مجال الذكاء الاصطناعي، من خلال إعادة تصميم تجربة العملاء، وخدمات الأعمال المصرفية التجارية، وإدارة المخاطر، والكفاءة التشغيلية، وإنتاجية الموظفين. أنشأ موظفو BBVA أكثر من 20,000 من GPT مخصصة داخلياً، ويُستخدم منها قرابة 4,000 بشكل متكرر في مجالات تشمل الشؤون القانونية،
المزيد
2026-06-12 19:26

باحثون يجدون أن وكلاء الذكاء الاصطناعي معرضون لهجمات حقن الأوامر، ويفيدون بنسبة نجاح بلغت 79%

وجدت دراسة نُشرت يوم الخميس أن عملاء الذكاء الاصطناعي المدعومين بـ GPT-5 وGemini لا يستطيعون مقاومة هجمات حقن الأوامر بشكل ثابت، وفقاً لبحث أجرته فرق من جامعة نانيانغ التكنولوجية وST Engineering وIBM Research وجامعة إلينوي في أوربانا شامبين. نجحت هجمات حقن الأوامر المباشرة في أكثر من 79% من الحالات ضمن 3,168 محاكاة للهجوم، بينما حققت الهجمات غير المباشرة المدمجة في محتوى الويب معدلات نجاح تراوحت بين 41.67% و68.16%. طوّر الباحثون StakeBench، وهو مقياس لاختبار استجابات عملاء الذكاء الاصطناعي لهذه
المزيد
2026-06-12 08:53

تطلق Google Antigravity لوحة تحكم للحمولات (الكوِتَا)، وتُعيد ضبط المخصصات الأسبوعية لـ Gemini

بحسب Beating، أطلقت Antigravity التابعة لـ Google لوحة معلومات لحمولة النماذج وإعادة ضبط المخصصات الأسبوعية لـ Gemini. تجمع اللوحة الجديدة النماذج التي تشترك في نفس صندوق الحصص (نماذج Gemini ونماذج Claude/GPT على حدة) مع عرض تفصيلي للنِّسَب المتاحة للحصة المتبقية. كما أضافت Antigravity ميزة السرد /btw، التي تتيح للمستخدمين طرح أسئلة متابعة أو طلب توضيحات أثناء المهام المعقدة دون تعطيل سجل المحادثة الرئيسي. وتشمل التحسينات الإضافية البحث في سجل المحادثات، ورفع المرفقات بصيغة PDF، وتحسين تنسيق LaT
المزيد
2026-06-11 07:01

قامت 0G Labs وجامعات شريكة باكتشاف 15 ثغرة يوم-صفر في بروتوكولات رئيسية لإجماع الشبكات

استنادًا إلى ورقة قُبلت في ICML 2026، قدّمت شراكة بحثية بين 0G Labs والجامعة الوطنية في سنغافورة وجامعة بكين وجامعة بكين للاتصالات الإلكترونية Agora، وهو إطار عمل آلي لاختبار أمن بروتوكولات الإجماع. حددت Agora 15 ثغرة عميقة غير معروفة سابقًا عبر بروتوكولات رئيسية تشمل Raft وEPaxos وHotStuff وBullShark. تمتد المشكلات التي تم تحديدها بين اختلافات التنفيذ، وانتهاكات الرتابة، وعيوب البنية (topology)، وأخطاء التحقق من التواقيع. وأظهر البحث أن نماذج لغوية كبيرة سائدة، بما في ذلك GPT-5.2 وClaude 4.5، ف
المزيد
2026-06-07 04:45

تكلّف نماذج الذكاء الاصطناعي مفتوحة المصدر 40 مرة أقل من GPT-5.5 Pro؛ تشامات يحذّر من الإفراط غير المراقَب في الإنفاق عبر واجهات البرمجة (API)

وفقًا لـ Beating، بعد إصدار 25 نموذجًا مفتوحًا للمصدر، بما في ذلك Nvidia Nemotron 3 Ultra وGoogle Gemma 4 12B، يتقلص الفارق في القدرات بين نماذج الصف الأول المفتوحة المصدر والمغلقة بسرعة، لكن التسعير لا يزال غير متسق على نحو صارخ. سلط المستثمر التقني تشاماث باليهاپيتييا الضوء على أنه بالنسبة إلى الشركات التي تستهلك 1 مليار رمز إدخال و1 مليار رمز إخراج شهريًا، تبلغ تكلفة GPT-5.5 Pro 105,000 دولار، وتكلف Claude Opus 4.8 نحو 30,000 دولار، بينما تبلغ تكلفة DeepSeek R1 2,740 دولار فقط، ما يجعل GPT-5.
المزيد
2026-06-05 01:30

تراجعت احتمالات إطلاق Polymarket GPT 5.6 إلى 21% بحلول 15 يونيو، منخفضة بنسبة 45% خلال 24 ساعة

وفقًا لــ Odaily Seer، انخفضت احتمالات Polymarket لإطلاق OpenAI GPT 5.6 قبل 15 يونيو إلى 21% اليوم، مسجلةً تراجعًا بنسبة 45% خلال الـ24 ساعة الماضية. كما بقيت احتمالات المنصة لصدور 30 يونيو عند 80%، بانخفاض 13% في الفترة نفسها.
2026-05-29 17:32

خمسة نماذج من طراز Frontier للذكاء الاصطناعي اختلفت على 67% من ادعاءات التحقق من الحقائق في أحدث دراسة

وبحسب الباحث كوستا جوردانوف في Lenz Research، اختلفت خمسة نماذج ذكاء اصطناعي “رائدة” على 67% من 1,000 ادعاء للتحقق من الحقائق في العالم الحقيقي تم اختبارها هذا الشهر. طُلب من النماذج—GPT-5.4 وClaude Opus 4.7 وGemini 3 Pro وGemini 3 Pro مع Search وSonar Pro—تصنيف الادعاءات على أنها صحيحة، أو على الأغلب صحيحة، أو مضللة، أو خاطئة. وفي 34% من الحالات، كان الخلاف شديداً، حيث اعتبر أحد النماذج الادعاء صحيحاً بينما صنّفه نموذج آخر بأنه خاطئ. قاسَت الدراسة درجة الاتفاق باستخدام ألفا كريبندورف (Krippendo
المزيد