#Multimodal AI
19 tools tagged “Multimodal AI”
GenMix
Bütünleşik AI platformu - 20'den fazla modellü video, resim ve ses oluşturma
wan2-6.org
Çift moda AI video üreticisi: Metin, resim ve referans girdileriyle 1080p klip üreterek.
Reka AI
Metin, resim, video ve sesleri anlamaya odaklanan multimodal temel modeller.
AMIE
Çok yönlendirilmiş bir AI tanılama aracı, akıllıca diagastik klinik konuşmalar ve tıbbi resimlerin doğru tespiti için tıbbi görüntüleri yorumlamaktadır.
chris li
Metin, resim veya sesi kısa videolar dönüştüren çok modlu AI video üreticisi.
Zenor AI
Shopin modellerinin Shopify mağazalarından text, ses, ve resim kullanarak çok modda bir AI alışveriş yardımcısı.
OpenAdapt
Açık kaynak bir framework, büyük multimodal modeller kullanarak masaüstü akış işlemlerini otomatikleştirir.
Gemini Omni
Çoklu modülli AI için üretim hazır video oluşturma, düzenleme ve oluşturma.
evolink
Birleşik API ile sohbet, görüntü ve video modelleri üzerinden çok modlu AI birleştiriliyor.
Seedance
Çok boyutlu AI platformu: metin-den videonun, resim-den videonun, metin-den resmin ve seslendirme oluşturmanın tümü.
HappyHorse-model
Metin ve medyadan metin girdiler kullanarak video, resim ve ses oluşturma için bir multimodal AI platformu.
Wan 2.7 AI Video Generator
Metin, görüntü ve referanslar için konsantre, kontrol edilebilir video oluşturmak için multimodal AI platformu.
Unitree R1
Kompakt 26-katımlı insanform robotu, multimodal AI için araştırma ve eğitim
C Dance ai
Metamodal AI video jeneratörü, metin, görüntü, ses ve klipleri dans videosu yapın.
Google Gemini 2.0
Google'ın multimodal AI modeli aganj görevler için, düşünme ve yerel araç kullanımına yönelik tasarlanmıştır.
Self-Operating Computer
Açık kaynaklı bir AI agenti, ekran görüşü ve fare/klipardan oluşan bir otomasyon aracı.
Gemini
Google'in multimodal AI model ailesi ile uzun süreli anlama ve MoE mimarisine sahip.
AssiPilot
Tüm içerik tipleri için tek bir AI yardımcısı: görüntüler, videolar, ses dosyaları ve müziği oluşturmak için
Seedance 2 AI Video Generator
Metin, resim ve sesin text-to-video oluşturması, multimodal AI video üreticisi, kısa sinematik klipler olarak dönüştürülüyor.


















