#Multimodal AI
19 tools tagged “Multimodal AI”
GenMix
20個以上のモデルを持つワンストップAIプラットフォーム
wan2-6.org
テキスト、画像、リファレンス入力から1080pの動画クリップを生成する、モードマルチのAI動画ジェネレータです。
Reka AI
マルチモーダル基礎モデルがテキスト、画像、ビデオ、音を理解する
AMIE
マルチモーダルなAI診断アジェントが、臨床会話を進めてメディカル・イメージを分析して正確な診断に貢献します。
chris li
テキストやイメージ、声から構成されたマルチモーダル AI ビデオジェネレータ
Zenor AI
多モーダルAIショッピングアシスタント用於Shopify店舗的テキスト、ボイス、イメージ
OpenAdapt
オープンソースフレームワークは、大型マルチモーダルモデルを使用してデスクトップワークフローを自動化します。
Gemini Omni
マルチモーダルAIによる、生成、編集、レンダリングの済み動画生成
evolink
統一されたAPIエンドポイントでマルチモーダルAIを横断
Seedance
マルチモーダルAIプラットフォームでテキストからビデオ、イメージからビデオ、テキストからイメージ、ボイスオーバー生成をサポート
HappyHorse-model
マルチモーダルAIプラットフォームでテキストまたはメディアの促進からビデオ・イメージ・オーディオを生成します。
Wan 2.7 AI Video Generator
テキスト、画像、リファレンスからの多モーダルAIプラットフォームで、一貫性のある動画を生成する。
Unitree R1
コンパクトな 26 尻式人間型ロボットにマルチモーダル AI を備えたリサーチとエデュケーション向け
C Dance ai
マルチモーダル AI ビデオ生成ツールでテキスト、画像、音声、動画を舞踊ビデオに変換します。
Google Gemini 2.0
多モーダルアーティファクトに搭載された Google のアクティブタスク用の AI モデル。
Self-Operating Computer
オープンソースのAIエージェント。画面の視覚とマウスとキーボードの制御を利用して、パソコンを管理します。
Gemini
Multi-modal AIモデル 家族、 Google の Google の長いコンテキストの理解と MoE アーキテクトチャ
AssiPilot
1つのすべてのAIアシスタントによる画像、ビデオ、ボイスオーバー、音楽の制作
Seedance 2 AI Video Generator
多モーダル AI ビデオ ジェネレーター。テキスト、画像、音を短いシネマティック クリップに変換します。


















