أعلنت جوجل للتو الجوزاء 3.5 ترجمة حية. إنه أحدث نموذج صوتي للترجمة المباشرة من الكلام إلى الكلام. تعني ميزة “تحويل…
نموذج
أصدر فريق Nemotron Speech التابع لـ NVIDIA Nemotron 3.5 ASR. إنه نموذج التعرف التلقائي على الكلام (ASR) المتدفق بمعلمة 600…
أصدرت Miso Labs MisoTTS، وهو نموذج مفتوح لتحويل النص إلى كلام بأوزان 8 مليارات معلمة. فهو يولد خطابًا معبرًا من…
أصدرت Google DeepMind للتو Gemma 4 12B، وهو نموذج كثيف متعدد الوسائط يستبعد أدوات التشفير التقليدية تمامًا. تتدفق الرؤية والصوت…
لقد أطلق فريق NVIDIA AI الكون 3. إنها عائلة من النماذج العالمية متعددة الوسائط للذكاء الاصطناعي المادي. تجمع النماذج بين…
أصدرت JetBrains Mellum2، وهو مصدر مفتوح للأوزان بموجب ترخيص Apache 2.0. كان الإصدار الأول من Mellum عبارة عن نموذج كثيف…
أصدرت Genesis AI إصدار Genesis World 1.0. تتكون المنصة من أربعة مكونات: محرك الفيزياء Genesis World، Nyx (عارض تتبع المسار…
أصدرت StepFun اليوم Step 3.7 Flash، وهو نموذج متعدد الوسائط لمزيج من الخبراء يستهدف حالات الاستخدام الوكيل. فهو يضيف مدخلات…
تم شحن الذكاء الاصطناعي السائل للتو LFM2.5-8B-A1B. وهو عبارة عن نموذج خليط من الخبراء (MoE) الموجود على الجهاز والذي تم…
أصدر مختبر الذكاء الاصطناعي StepFun، ومقره شنغهاي، برنامج StepAudio 2.5 Realtime. إنه نموذج لغة كبير للكلام في الوقت الفعلي من…