"MoE" 的搜索结果
共找到5个结果(工具4个· 资讯1篇· 技能0个),SeoAIu已按相关性为你排序。
AI工具 (4)
腾讯混元大模型:从实用主义出发,腾讯AI重建后的智能效率革命者
175腾讯混元是由腾讯自主研发的产业级AI大模型,经过2026年2月对预训练与强化学习基础设施的重建,以“实用主义”为核心重新定位。2026年4月发布的混元3.0(Hy3 preview)是一款融合快慢思考机制的2950亿参数(激活210亿)混合专家架构大模型,最大支持256K上下文窗口。模型在复杂推理、指令遵循、代码生成与智能体(Agent)任务处理四大核心能力上实现全面提升:在SWE-Bench上的编程得分从53.0%跃升至74.4%;在FrontierScience Olympiad、IMO Answer Bench、清华求真书院数学博资考等权威评测中均取得领先成绩,整体推理效率较前代提升40%。Hy3 preview模型代码与权重已完全开源,具备“快思考+慢思考”的双思维系统——快思考模型Turbo S主打秒级响应,慢思考模型(基于思维链)深耕逻辑推导,双模融合实现了大模型端到端的智能化升级。目前,混元大模型已在元宝、QQ、腾讯文档、CodeBuddy、WorkBuddy及微信搜索等众多腾讯生态核心产品中落地,并在金融、ETC、零售等行业广泛应用,获多项行业落地验证。
2026-06-03文心大模型:百度十年磨一剑的产业级知识增强大模型
160文心大模型(ERNIE)是百度自主研发的产业级知识增强大模型,从2019年发布1.0版本起步,历经多代技术迭代,已构建起基础大模型、任务大模型、行业大模型三级体系。2025年11月发布的文心5.0实现原生全模态统一建模,参数量达2.4万亿,支持文本、图像、音频、视频的全模态理解与生成。2026年5月发布的文心5.1在搜索能力上位列国内第一、全球第四,预训练成本仅为业界6%。平台通过千帆大模型平台为开发者提供模型训练、部署、监控的全生命周期管理,已汇聚超过19万款标准化组件,服务8.5万家企业客户。
2026-06-03阿里巴巴M6——全球首个10万亿参数多模态大模型,能耗却只有GPT-3的1%
135M6是阿里巴巴达摩院研发的通用多模态大模型,2021年10月成为全球首个10万亿参数AI预训练模型。基于自研Whale分布式框架,仅用512张V100 GPU、10天即完成训练,能耗仅为GPT-3的1%。支持图文生成、视觉问答、诗歌创作等任务,已在天猫虚拟主播、淘宝搜索等40余个场景落地,是通义千问大模型的核心前身。
2026-07-02DeepSeek深度求索AI对话与API平台,探索AGI前沿的通用大模型
49DeepSeek(深度求索)成立于2023年,专注于研究世界领先的通用人工智能底层模型与技术。平台提供免费AI对话、API开放接口调用,已发布并开源多个百亿级参数大模型,包括DeepSeek-LLM通用大语言模型、DeepSeek-Coder代码大模型、DeepSeek-MoE混合专家模型等。最新DeepSeek-V4版本具备世界顶级推理性能,Agent能力大幅提升,可在网页端、APP和API使用,助力开发者快速集成与流畅体验。
2026-07-22