MiniMax H3正式发布:新一代能力全面升级

19小时前更新 kw178
0 0 0

稀宇科技正式推出 MiniMax H3。该模型定位为通用全模态生成模型,支持对文本、图像、视频与声音构成的多模态上下文进行统一理解,并可输出具备原生双声道能力的音视频内容,最高支持 15 秒、2K 分辨率。

MiniMax H3正式发布:新一代能力全面升级的封面图

相关快讯

MiniMax H3正式发布:新一代能力亮相

MiniMax正式发布通用全模态生成模型H3,支持统一理解文本、图像、视频和声音等多模态上下文,可生成原生双声道音视频,最高支持15秒、2K分辨率内容。MiniMax还表示,未来几天将在符合法律法规前提下开放模型权重。

Anthropic发布Opus 5:性能接近Fable 5,价格却只要一半

Anthropic在57天内密集更新Claude多条产品线:先后发布Opus 4.8、Fable 5、Mythos 5、Sonnet 5和Opus 5。最新Opus 5性能接近旗舰Fable 5,但价格减半,体现出其在AI模型迭代上的极快节奏。

腾讯混元架构调整:合并大语言模型与多模态团队,加速模型研发

腾讯混元进行架构调整,将多模态模型部门与大语言模型部门合并为基础模型部,由首席 AI 科学家姚顺雨统一管理,以提升研发和协同效率,推动全模态模型探索。近年来,混元已形成图像、视频、语音、3D 生成等完整模型矩阵,且 2026 年以来迭代速度加快,与腾讯业务协同不断增强。

千问为何还是不够自信?

这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。

Meshy完成近4亿美元B轮融资,持续加码AI 3D生成技术

Meshy今日完成近4亿美元B轮融资,投后估值超100亿元人民币,创AI 3D领域单轮融资规模和估值新纪录。IDG资本、经纬中国、Monolith砺思资本等参与投资,老股东也大幅跟投。资金将用于AI多模态模型研发和全球市场拓展。

阿里通义实验室发布 Wan-Streamer v0.2:AI 视频电话响应延迟降至 550ms

阿里通义实验室发布 Wan-Streamer v0.2,面向实时双工交互,将听、看、说、演统一到单个 Transformer 中,支持文本、音频、视频的端到端实时理解与同步生成。模型端到端延迟约 550ms,较常见实时语音对话系统更快;输出分辨率提升至 640×368@25FPS,微表情和细节表现更清晰。

暂无评论

暂无评论...