"多模态AI" 的搜索结果

共找到7个结果(工具4个· 资讯2篇· 技能1个),SeoAIu已按相关性为你排序。

AI工具 (4)

阿里巴巴M6——全球首个10万亿参数多模态大模型,能耗却只有GPT-3的1%

136
阿里巴巴M6——全球首个10万亿参数多模态大模型,能耗却只有GPT-3的1%
AI Tools

M6是阿里巴巴达摩院研发的通用多模态大模型,2021年10月成为全球首个10万亿参数AI预训练模型。基于自研Whale分布式框架,仅用512张V100 GPU、10天即完成训练,能耗仅为GPT-3的1%。支持图文生成、视觉问答、诗歌创作等任务,已在天猫虚拟主播、淘宝搜索等40余个场景落地,是通义千问大模型的核心前身。

2026-07-02

GPT-4o——OpenAI的全能多模态旗舰模型,实时语音视频交互,免费向所有用户开放

79
GPT-4o——OpenAI的全能多模态旗舰模型,实时语音视频交互,免费向所有用户开放
AI Tools

GPT-4o(“o”代表Omni)是OpenAI于2024年5月发布的新一代旗舰级多模态大模型。它能跨文本、音频、图像和视频进行实时推理,最快232毫秒响应音频,接近人类对话反应速度。具备感知情绪、实时翻译、图像生成等突破性能力。API速度是GPT-4 Turbo的两倍,成本仅为一半,并向所有ChatGPT免费用户开放。

2026-07-14

Gemini 3.5 多模态AI模型,支持代码、知识工作与多模态任务的高效推理

58
Gemini 3.5 多模态AI模型,支持代码、知识工作与多模态任务的高效推理
AI Tools

Gemini 3.5是Google DeepMind推出的新一代多模态AI模型,专注于代码生成、知识推理和多模态任务的高效处理。它通过优化的架构和训练方法,在保持高性能的同时大幅降低了计算成本,特别适合需要快速迭代和资源敏感的应用场景。

2026-07-22

Vozo AI 视频翻译与配音唇同步工具

58
Vozo AI 视频翻译与配音唇同步工具
AI Tools

Vozo AI 是一款基于人工智能的视频本地化工具,支持160多种语言的翻译、配音、唇同步、字幕和屏幕文本处理。专为创作者、营销人员和教育工作者设计,利用多模态AI理解场景、上下文和语调,实现自然、流畅且高精度的视频本地化,显著提升效率并降低成本。

2026-07-17

AI资讯 (2)

职业技能 (1)