苹果洽谈AI初创公司,计划让大模型直接在iPhone上运行

6天前更新
4 0 0

苹果正与AI初创公司 PrismML 展开初步接触,并同步评估其AI模型压缩技术,目标是推动大型AI模型直接在 iPhone 端运行,减少对云端计算的依赖。

PrismML 宣称,该技术可将模型内存占用压缩10至15倍,使参数规模达270亿的模型能够在 iPhone 15 及以上机型上本地运行,同时将响应速度提升6至8倍、能耗降低3至6倍。

如果相关技术最终落地,苹果有望把更多 Siri 和生成式AI功能迁移至端侧执行,从而进一步提升系统响应效率、增强隐私保护、改善离线使用体验,并同步压缩云计算成本。

苹果洽谈AI初创公司,计划让大模型直接在iPhone上运行的封面图

相关快讯

智谱1吉瓦AI数据中心建成,已启动部分运营

智谱AI近日建成并部分启用一座供电规模达1GW的AI数据中心,引发全球AI圈关注。作为中国“大模型六小虎”中技术积累最深的公司之一,其GLM系列已迭代至GLM-5.2,性能对标GPT;ChatGLM拥有数百万用户,并持续在GitHub、HuggingFace开源。公司2024年还完成超20亿元融资,估值超120亿元。

Kimi K3发布后,真正坐不住的不是英伟达

月之暗面发布Kimi K3,凭借2.8万亿参数、原生多模态和100万上下文窗口引发行业震动。开发者关注其KDA、AttnRes和MoE架构,资本市场则担忧模型领先优势窗口缩短,带动智谱、MiniMax等股价大跌。随后又出现“K3提升效率或冲击算力需求、拖累半导体股”的更激烈解读。

千问发布语音合成大模型 Qwen-Audio-3.0-TTS

千问正式发布语音合成大模型 Qwen-Audio-3.0-TTS,支持通过自然语言进行 Free-style 指令控制,提升了语音生成的灵活性与可用性。该模型提供面向实时交互的 Flash 版本,首包延时可达 300ms 级别,也提供面向高质量生成的 Plus 版本,满足不同场景需求。

千问为何还是不够自信?

这段内容主要在讨论国产大模型近期密集发布的竞争格局。Kimi K3先声夺人,DeepSeek v4又将登场,qwen3.8夹在中间显得有些尴尬:能力要面对K3,性价比还要和v4较量。但阿里此次明确开源qwen3.8,也释放出重要信号,说明其在技术和生态策略上都有布局。

每刻深思携空间光计算方案亮相WAIC,宣布与科华数据达成战略合作

WAIC 2026期间,每刻深思与阶跃联合参展,展示空间光计算芯片与大模型全栈融合方案,并基于STEP 3.7实现实景推理加速,提升效率、降低成本。同时,公司与科华数据达成“算电冷协同”战略合作,围绕UPS、液冷和异构算力协同推进绿色算力方案落地。

阿里巴巴发布语音合成大模型 Qwen-Audio-3.0-TTS

阿里巴巴于7月20日发布语音合成大模型Qwen-Audio-3.0-TTS,在细粒度控制、自由指令、多语种方言和复杂声学鲁棒性上全面提升,并推出实时交互的Flash版和高质量生成的Plus版,使语音合成从“能说话”迈向“会表达”。目前Plus版已登顶Artificial Analysis榜单,预览版也曾夺冠。

暂无评论

暂无评论...