MiniMax H3, Yapay Zeka Video Sıralamasında Zirveye Yerleşen İlk Açık Model Oldu

Çin merkezli yapay zeka girişimi MiniMax, geliştirdiği H3 video modelinin ağırlıklarını erişime açarak sektörde önemli bir eşiği aştı. Artificial Analysis tarafından hazırlanan güncel sıralamalarda video düzenleme kategorisinde birinci, metinden videoya dönüştürme alanında ikinci ve görselden videoya dönüştürme kategorisinde üçüncü sırada yer alan bu model, açık kaynaklı yapay zeka dünyasında bir ilki temsil ediyor.
33 milyar parametreli bu mimari; metin, görüntü, video ve ses verilerini aynı anda işleyebilme yeteneğine sahip. Kullanıcılar tek bir komutla dokuz referans görseli, üç video klibi ve üç ses dosyası kullanarak dört ile 15 saniye arasında uzunluğa sahip, stereo ses destekli videolar üretebiliyor. ComfyUI üzerinden yerel olarak çalıştırılabilen model, özelleştirilmiş karakterler veya görsel stiller üzerinde ince ayar yapılmasına da olanak tanıyor.
Ancak modelin tüm yetenekleri açık kaynak dünyasına sunulmuş değil. 2K çözünürlük modülü ve komutları yapılandırılmış bir formata dönüştüren H3-Context-IR bileşeni kapalı tutuluyor. Bu nedenle yerel kurulumlarda çözünürlük 768p ile sınırlı kalıyor ve kullanıcıların bağlam hazırlığı süreçlerini şirketin yayınladığı kılavuzlara göre manuel yönetmesi gerekiyor. Ayrıca modelin ticari kullanımı, yıllık 20 milyon doların altında geliri olan şirketlerle sınırlandırılmış durumda.
Sektördeki hareketlilik devam ederken, ByteDance de aynı gün içerisinde 30 saniyeye kadar video üretebilen ve ses entegrasyonu sunan kapalı kaynaklı Seedance 2.5 modelini duyurdu.



