当下,仅豆包一家大模型的日均 Token 调用量就已突破 180 万亿;AI 编程、Agent 工作流、多模态内容生成等场景,也正不断被卷入这条快速上扬的消耗曲线之中,Token 经济正以罕见速度扩张。
几乎在同一时间,OpenAI 公布的第一季度经营亏损高达 93 亿美元,调整后营业利润率约为 -122%,意味着每收入 1 美元,就要倒贴约 1.22 美元。
于是,一个略显反差的对照随之浮现:一边是消耗量指数级攀升、被寄予“新增长极”厚望的 Token 经济,上游 GPU、HBM 厂商不断刷新利润纪录;另一边,从模型厂商、Token 工厂,到算力中心和 AI 应用,大多数企业仍在增长中承压亏损,甚至陷入“越卖越亏”的困境。
相关快讯
智谱1吉瓦AI数据中心建成,已启动部分运营
智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。
Kimi K3发布后,真正坐不住的不是英伟达
月之暗面发布Kimi K3,凭借2.8万亿参数、原生多模态和100万上下文窗口引发行业震动。开发者关注其KDA、AttnRes和MoE架构,资本市场则担忧模型领先优势窗口缩短,带动智谱、MiniMax等股价大跌。随后又出现“K3提升效率或冲击算力需求、拖累半导体股”的更激烈解读。
陆川谈 AI:像“预制菜”,正用来同时推进五部电影筹备
新浪财经联合美国中国总商会在纽约举办“超越赛场——中美商业、人工智能与全球协作”私享会。陆川称,AI让他更珍惜当下的创作机会,也让传统电影创作窗口更显珍贵,并形容AI生成影像像“预制菜”。他此前已宣布与MiniMax合作开发电影质感级AI漫剧,并计划延伸至院线电影和剧集。
千问发布语音合成大模型 Qwen-Audio-3.0-TTS
千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS,支持通过自然语言进行 Free-style 指令控制,提升了语音生成的灵活性与可用性。该模型提供面向实时交互的 Flash 版本,首包延时可达 300ms 级别,也提供面向高质量生成的 Plus 版本,满足不同场景需求。
英伟达被曝大规模收购美国暗光纤资源,潜在带宽达 7.6 Pb/s
报告称,英伟达正加大在美国的长途光纤网络布局,收购大量暗光纤容量,为未来 AI 基础设施做准备。按单根光纤80至96个波长、每通道800Gbps估算,100对光纤理论总带宽可达约7.6Pb/s。随着生成式AI训练和推理规模扩大,跨数据中心高速互联正成为AI工厂建设的关键。
千问为何还是不够自信?
这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。