الاقتصادية

ديب سيك تختبر نموذجًا جديدًا لفهم الصور ومنافسة النماذج الأمريكية المتقدمة

تواصل شركة ديب سيك الصينية توسيع قدرات نماذجها للذكاء الاصطناعي، بعدما كشفت عن إصدار تجريبي جديد يستطيع التعامل مع المحتوى المرئي، في خطوة تنقل نماذجها من الاعتماد على النصوص وحدها إلى فهم الصور ولقطات الشاشة وتحليلها.

وأوضحت الشركة أن النموذج الجديد يمثل نسخة تجريبية مطورة من نموذجها V4-Flash، الذي كان يركز بصورة أساسية على معالجة النصوص، قبل أن تضيف إليه قدرات متعددة الوسائط تتيح له تفسير المدخلات البصرية والتفاعل معها.

وبحسب ديب سيك، فإن النموذج التجريبي أظهر نتائج قوية في اختبارات تقييم القدرات متعددة الوسائط، حيث اقترب أداؤه من مستوى نموذج Opus 4.8 التابع لشركة أنثروبيك الأمريكية، وفق ما أعلنته الشركة عبر منصة «إكس».

ولا تقتصر إمكانات النموذج على التعرف إلى الصور فحسب، بل تمتد إلى التعامل مع المعلومات المرئية واتخاذ إجراءات استنادًا إليها، مع قدرة على تنفيذ بعض المهام دون الحاجة إلى إشراف أو توجيه مستمر من المستخدم.

ويعكس هذا التطور اتجاهًا متسارعًا في صناعة الذكاء الاصطناعي نحو النماذج متعددة الوسائط، التي تجمع بين فهم النصوص والصور وغيرها من أنواع البيانات، بما يسمح باستخدامها في مجموعة أوسع من التطبيقات والمهام الرقمية.

وتأتي خطوة ديب سيك في وقت تشهد فيه المنافسة بين شركات الذكاء الاصطناعي الصينية والأمريكية تصاعدًا ملحوظًا، مع تركيز الشركات على تطوير نماذج أكثر قدرة على فهم السياق وتنفيذ المهام بصورة مستقلة.

ومن شأن إضافة القدرات البصرية إلى نموذج V4-Flash أن توسع نطاق استخدامه مقارنة بالإصدارات المعتمدة على النصوص فقط، خصوصًا في المهام التي تتطلب تحليل واجهات المستخدم ولقطات الشاشة أو فهم المعلومات المرئية إلى جانب التعليمات المكتوبة.

 

 

 

اظهر المزيد

مقالات ذات صلة

اترك تعليقاً

لن يتم نشر عنوان بريدك الإلكتروني. الحقول الإلزامية مشار إليها بـ *

زر الذهاب إلى الأعلى