Stability AI تكشف عن نموذج صوتي على الجهاز بينما يتقدم المنافسون
إصدار نموذج صوتي على الجهاز
أصدرت Stability AI نموذج Audio 3.0 الصغير، وهو نموذج توليدي يعمل على الهاتف أو الكمبيوتر المحمول ويولد مسارات قصيرة تصل إلى دقيقتين.
توليد الصوت على الجهاز
تشغيل الشبكة العصبية محليًا يعني عدم وجود زمن تأخير في الشبكة ولا بيانات تترك الجهاز. العرض التوضيحي العام يحدد المسارات عند دقيقتين، على الرغم من أن الهندسة الأساسية يمكن أن تمتد إلى ست دقائق. سيحتاج المهندسون إلى موازنة استخدام CPU/GPU مقابل استهلاك البطارية إذا دفعوا جلسات أطول.
الميكانيكيات الفنية لتوليد الصوت على الجهاز
القدرة على توليد الصوت على الجهاز تعتمد على هندسة النموذج وقدرات الأجهزة للجهاز. قرار Stability AI باعتماد نهج على الجهاز يعني التركيز على تقليل زمن التأخير وتعزيز تجربة المستخدم.
الدفع الأوسع لنماذج الذكاء الاصطناعي على الجهاز
مساعد Figma الذكي، الذي تم الإعلان عنه لـ Figma Design، يتبع نفس الاتجاه للوصول على الجهاز. يقدم المساعد اقتراحات دون توجيه كل ضغطة مفتاح إلى السحابة.
تاريخ تطوير الذكاء الاصطناعي على الجهاز
تطوير الذكاء الاصطناعي على الجهاز ليس ظاهرة جديدة. المحاولات السابقة لدمج الذكاء الاصطناعي في الأجهزة كانت لها درجات نجاح مختلفة.
نماذج مركزية للوكلاء تدخل الساحة
أعلنت Qwen عن نموذج Qwen 3.7-Max، الذي يستهدف مهام معقدة مثل استخدام الأدوات والتخطيط متعدد الخطوات.
الديناميكيات التنافسية والأسئلة المفتوحة
تظهر Stability AI وFigma وApple وQwen تحولًا: الذكاء الاصطناعي يتحرك من واجهات برمجة التطبيقات السحابية فقط إلى تجارب متكاملة.