#Multimodal AI
19 tools tagged “Multimodal AI”
#1
GenMix
一体化 AI 平台,20+ 模型助力视频、图像、语音创作
4.7 (6)
Freemium
#2
wan2-6.org
多模态 AI 视频生成器,支持从文本、图像和参考输入生成 1080p 短片
4.8 (4)
Free
#3
Reka AI
多模态基础模型,理解文本、图像、视频和音频。
5.0 (5)
Freemium
#4
AMIE
一种多模态人工智能诊断代理,通过临床对话和医疗图像解读实现精准诊断。
4.7 (6)
Free
#5
chris li
多模态 AI 视频生成器,将文字、图片或音频转化为短视频。
4.5 (6)
Free
#6
Zenor AI
多modal AI购物助手,使用文本、语音和图像为Shopify商店
4.8 (6)
Free
#7
OpenAdapt
开源框架:使用大型多模式模型自动化桌面工作流
5.0 (5)
Freemium
#8
Gemini Omni
多模态 AI 生成器、编辑器和渲染器,实时创作高质量视频内容。
4.0 (4)
Free
#9
evolink
面向聊天、图像和视频模型的多模态 AI 统一 API。
4.8 (5)
Freemium
#10
Seedance
多模态 AI 平台,支持文本转视频、图像转视频、文本转图像和语音添加功能
4.6 (5)
Free
#11
HappyHorse-model
用于从文本或媒体提示生成视频、图像和音频的多模态AI平台。
4.8 (6)
Free
#12
Wan 2.7 AI Video Generator
多模式AI平台:从文本、图片和参考生成一致、可控的视频
4.2 (6)
Free
#13
Unitree R1
紧凑的26关节人形机器人,多模式人工智能辅助研究与教学
4.5 (4)
Paid
#14
C Dance ai
多模态 AI 视频生成器,可将文本、图像、音频和片段转化为舞蹈视频。
4.5 (4)
Free
#15
Google Gemini 2.0
Google 最新的多模态 AI 模型,专为-agent 任务、推理和原生工具使用而设计。
4.8 (4)
Freemium
S
#16
Self-Operating Computer
开源 AI 代理,通过屏幕视觉和鼠标/键盘控制来操作您的电脑
4.7 (6)
Freemium
#17
Gemini
谷歌的多模态AI模型家族,具有长上下文理解和MoE架构
4.2 (5)
Freemium
#18
AssiPilot
一站式 AI 助手,轻松创作图像、视频、配音和音乐
4.6 (5)
Freemium
#19
Seedance 2 AI Video Generator
多模态人工智能视频生成器,可以将文字、图片和音频转换为短片式的影视短片。
4.5 (6)
Free


















