美国大模型跟进DeepSeek架构,开始借鉴中国路径

2小时前更新 18702252110
1 0 0

OpenAI 前首席技术官穆拉蒂,这次推出了一款中国模型的“贵替”。Thinking Machines 发布的首个模型 Inkling,在混合专家架构上主要沿用了 DeepSeek-V3,后训练的冷启动阶段还借助了 Kimi K2.5 等开放模型生成的数据。不过在多项基准测试中,Inkling 不仅落后于 Kimi 和 GLM,调用价格也更高。

对于这家融资 20 亿美元、估值 120 亿美元,且汇聚了大量 OpenAI 前员工的明星公司来说,这样的表现多少显得不及外界预期。

但穆拉蒂或许从一开始就没打算让 Inkling 去争夺第一。随着美国企业使用中国模型面临越来越多不确定性,一款性能尚可、支持定制、合规风险更低的本土开放模型,已经具备了自己的市场空间。换句话说,“贵替”未必足够强,但也未必缺市场。

美国大模型跟进DeepSeek架构,开始借鉴中国路径的封面图

相关快讯

阿里千问 App 推出“暑期 AI 通识课”,覆盖小学全学段

阿里联合上海交通大学学生创新中心,在千问 App“千问小讲堂”推出面向全国学生免费开放的“千问 AI 创想课堂”暑期 AI 通识课。课程依托千问的 AI 能力,围绕对话、创作、探索等场景,融入适合小学生的教学设计,帮助孩子在暑假中既学 AI,也用 AI 动手实践。课程按年级递进设置,分别引导低年级认识 AI、中年级辅助学习、高年级完成创作项目。

CoreWeave首席执行官透露:公司正加速大规模部署AI基础设施

CoreWeave首席执行官表示,公司正大规模部署AI基础设施,AI原生云建设方向正确。随着AI云收入持续增长,折旧带来的会计影响预计将逐步减弱。

谷歌一口气发布多款Gemini模型,旗舰Pro版发布时间仍未公布

谷歌7月21日发布三款更低成本的Gemini模型,覆盖通用与网络安全场景,以满足不必使用最高性能模型的需求。但旗舰版Gemini 3.5 Pro仍未明确发布时间,因内部测试中代码生成表现不及预期而延期数周,目前正与合作伙伴测试,预计“近期”推出。

北京布局建设Token工厂,下半年力争新增智能算力5万P

北京上半年数字经济增速7.8%,核心产业增速9.8%,对GDP拉动明显。下半年将推进人工智能全域赋能,推动文旅、工业、教育等场景应用,制定Token经济政策,建设相关平台与工厂,并举办OPC路演、开发AIGC课程。同时打造“RISC-V+AI OS”开源生态,力争新增智能算力5万P,年内总规模超13万P。

AI平台预测最佳量子点薄膜制备溶剂组合

韩国首尔大学团队开发出基于AI的QLED制备工艺设计平台,可反向设计量子点薄膜条件并预测最佳溶剂组合。应用于器件制造后,QLED效率提升约一倍,运行寿命延长超过40倍。

OpenAI宣布:ChatGPT Work和GPT-5.6今日起向小型企业开放

OpenAI宣布推出面向小型企业的ChatGPT服务计划,ChatGPT Work和GPT-5.6自今日起向小型企业开放,进一步拓展了面向企业场景的产品覆盖。(财联社)

暂无评论

暂无评论...