DeepSeek-V4-Flash-Vision-Exp已在DeepSeek API平台正式上线。官方称其纯文本能力与DeepSeek-V4-Flash正式版持平,而在视觉理解类Agent Benchmark上表现显著...
大模型公司西湖心辰完成B+轮融资,金额数亿元人民币,由广发信德领投,多家机构及产业资本跟投,老股东蚂蚁集团、汤姆猫持续支持。资金将用于新一代扩散语言...
Meshy 在营收快速增长后完成近 4 亿美元 B 轮融资,投后估值超 100 亿元人民币,成为全球估值最高的 AI 3D 公司,并刷新赛道单轮融资和估值纪录。3D 因同时需...
过去一年,AI 最确定的突破发生在 Coding,从 Copilot 到 Agentic Coding,代码率先被 AI 打穿。商汤在 2026 WAIC 发布 SenseNova U1 Pro,定位为面向长程任...
7月17日,文远知行正式发布自研物理AI认知基础大模型WeRide WITT。该模型基于视觉语言大模型能力,首次引入“最小物理事实单元”概念,融合视频、图像、文本等...
据报道,OpenAI 前研究员田永龙近期加入腾讯,若成行,这将是继姚顺雨之后,又一位从 OpenAI 核心研究团队转投腾讯混元的研究人员。姚顺雨已于 2025 年 9 月...
网易有道近日宣布“子曰”大模型升级至4.0版本,正式进入全模态时代。该版本全面支持文本、图片和音频的融合交互。此外,有道还宣布将“多模态模型”和“语音合成...
字节跳动计划推出其AI视频生成模型Seedance 2.1的升级版本,预计生成质量提升约20%。然而,接近字节跳动的人士对此传言表示不实。Seedance 2.0于今年2月正式...
国内多模态生成式人工智能公司“智象未来”近日宣布完成超5亿元的新一轮融资,投资方包括东方富海、安徽省投资集团、省产业投资公司和峰华资本等新股东,以及合...
火山引擎推出了Seedance 2.0系列API服务,支持文字、图片、音频和视频四种输入模态。该服务建立了肖像与版权安全标准,确保视频生成过程中涉及的各种模态和创...
微软正在开发高性能的前沿大模型,以减少对OpenAI模型的依赖。微软AI首席执行官穆斯塔法・苏莱曼在彭博社的采访中表示,公司计划打造适用于文本、音频和图像...
DeepSeek发布新多模态模型
DeepSeek-V4-Flash-Vision-Exp已在DeepSeek API平台正式上线。官方称其纯文本能力与DeepSeek-V4-Flash正式版持平,而在视觉理解类Agent Benchmark上表现显著...
jamesli
in 未分类