{"id":37051,"topic":"ai","source":"富途牛牛","title":"苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路 - 富途牛牛","url":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","url_hash":"2fe29b3b734bafc0e0d8194cad67dc7782b7b44a","author":"","summary":"<a href=\"https://news.google.com/rss/articles/CBMisgFBVV95cUxQZlRCalZBSGNhaFAyQ3VTZ1oyT3o1VWNNV1UzZWUxYk1FOVI5cDE2SW8yWUJPV0o1TVBWWUFQTVg2RTh2ZzhHQVFsbG53T0cwOFRKQ1kyTUtiQXZzeHZaZFJPQ244TE9DZFBJNWktWHlzc3A3cUdzY0Y0M2ZPb1R2WGZiSlFZR3NzZHJEN2drQkVtd2tSd1F1U0xOTDFaOC1fZVQ4Z3BBOU5VWGhxYjkzSVNn?oc=5\" target=\"_blank\">苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">富途牛牛</font>","content":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A. Davidson分析师Gil Luria表示，模型瘦身并不会消除对处理器或内存的需求，只是将更多芯片从数据中心转移至手机等终端设备。\"你仍然需要GPU，仍然需要内存，\"他说。\n他还补充，在单一设备上运行AI实际上可能比共享数据中心基础设施效率更低，因为手机芯片大多数时候处于闲置状态。此外，效率突破往往催生更多使用需求，而非带来支出下降。\n市场对\"AI所需内存少于预期\"的信号向来反应灵敏。今年3月，谷歌发布TurboQuant论文——涉及在不损害模型性能的前提下削减内存使用——美光科技股价随即大幅下跌，尽管此后有所回升。\n编辑/lambor","image_url":"https://newsfile.futunn.com/news-thumbnail/20240704/public/17200754083743649912813-news-thumbnail/20240704/public/17200754083745142172907.jpg","lang":"zh","published_at":"2026-07-14T23:29:18+00:00","fetched_at":"2026-07-15T06:15:07+00:00","status":"read","starred":0,"extract_state":"ok","summary_auto":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A.","cluster_id":1771651,"extract_retries":0,"extract_error":null,"contract_version":"news_item.v1","format_contract_version":"news_item_formats.v1","dedup_url":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2295 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2295,"summary_length":2022,"usable_text_length":2295,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2295,"summary_length":2022}},"news_item":{"id":37051,"canonical_url":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","source_url":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","title":"苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路 - 富途牛牛","source_name":"富途牛牛","author":null,"published_at":"2026-07-14T23:29:18+00:00","locale":"zh","topic":"ai","tags":[],"rss_summary":"<a href=\"https://news.google.com/rss/articles/CBMisgFBVV95cUxQZlRCalZBSGNhaFAyQ3VTZ1oyT3o1VWNNV1UzZWUxYk1FOVI5cDE2SW8yWUJPV0o1TVBWWUFQTVg2RTh2ZzhHQVFsbG53T0cwOFRKQ1kyTUtiQXZzeHZaZFJPQ244TE9DZFBJNWktWHlzc3A3cUdzY0Y0M2ZPb1R2WGZiSlFZR3NzZHJEN2drQkVtd2tSd1F1U0xOTDFaOC1fZVQ4Z3BBOU5VWGhxYjkzSVNn?oc=5\" target=\"_blank\">苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路</a>&nbsp;&nbsp;<font color=\"#6f6f6f\">富途牛牛</font>","full_text":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A. Davidson分析师Gil Luria表示，模型瘦身并不会消除对处理器或内存的需求，只是将更多芯片从数据中心转移至手机等终端设备。\"你仍然需要GPU，仍然需要内存，\"他说。\n他还补充，在单一设备上运行AI实际上可能比共享数据中心基础设施效率更低，因为手机芯片大多数时候处于闲置状态。此外，效率突破往往催生更多使用需求，而非带来支出下降。\n市场对\"AI所需内存少于预期\"的信号向来反应灵敏。今年3月，谷歌发布TurboQuant论文——涉及在不损害模型性能的前提下削减内存使用——美光科技股价随即大幅下跌，尽管此后有所回升。\n编辑/lambor","excerpt":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A.","extraction":{"state":"ok","confidence":0.9,"error":null,"explanation":"High confidence: full text extraction produced 2295 characters.","diagnostics_url":"/api/diagnose?url=https%3A//news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2295 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2295,"summary_length":2022,"usable_text_length":2295,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2295,"summary_length":2022}}},"display_formats":["compact","card","full","digest_section","json"]},"daily_stack_record":{"title":"苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路 - 富途牛牛","url":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","summary":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A.","source":"富途牛牛","date":"2026-07-14T23:29:18+00:00","content":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A. Davidson分析师Gil Luria表示，模型瘦身并不会消除对处理器或内存的需求，只是将更多芯片从数据中心转移至手机等终端设备。\"你仍然需要GPU，仍然需要内存，\"他说。\n他还补充，在单一设备上运行AI实际上可能比共享数据中心基础设施效率更低，因为手机芯片大多数时候处于闲置状态。此外，效率突破往往催生更多使用需求，而非带来支出下降。\n市场对\"AI所需内存少于预期\"的信号向来反应灵敏。今年3月，谷歌发布TurboQuant论文——涉及在不损害模型性能的前提下削减内存使用——美光科技股价随即大幅下跌，尽管此后有所回升。\n编辑/lambor","confidence":0.9,"diagnostics_url":"/api/diagnose?url=https%3A//news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","quality_bucket":"high","failure_kind":"none","retryable":false,"quality_reason":"High confidence: full text extraction produced 2295 characters.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2295 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2295,"summary_length":2022,"usable_text_length":2295,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2295,"summary_length":2022}},"tags":[]},"fallback_formats":["markdown","json","html"],"actions":{"read":"/item/37051","export_markdown":"/api/items/37051/export?format=markdown","export_json":"/api/items/37051/export?format=json","diagnose":"/api/diagnose?url=https%3A//news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large"},"formats":{"full":{"id":37051,"title":"苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路 - 富途牛牛","url":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","source":"富途牛牛","author":null,"published_at":"2026-07-14T23:29:18+00:00","locale":"zh","topic":"ai","tags":[],"excerpt":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A.","full_text":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A. Davidson分析师Gil Luria表示，模型瘦身并不会消除对处理器或内存的需求，只是将更多芯片从数据中心转移至手机等终端设备。\"你仍然需要GPU，仍然需要内存，\"他说。\n他还补充，在单一设备上运行AI实际上可能比共享数据中心基础设施效率更低，因为手机芯片大多数时候处于闲置状态。此外，效率突破往往催生更多使用需求，而非带来支出下降。\n市场对\"AI所需内存少于预期\"的信号向来反应灵敏。今年3月，谷歌发布TurboQuant论文——涉及在不损害模型性能的前提下削减内存使用——美光科技股价随即大幅下跌，尽管此后有所回升。\n编辑/lambor","reading_time_min":1,"extraction":{"state":"ok","confidence":0.9,"error":null,"explanation":"High confidence: full text extraction produced 2295 characters.","diagnostics_url":"/api/diagnose?url=https%3A//news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2295 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2295,"summary_length":2022,"usable_text_length":2295,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2295,"summary_length":2022}}},"quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2295 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2295,"summary_length":2022,"usable_text_length":2295,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2295,"summary_length":2022}},"actions":{"read":"/item/37051","export_markdown":"/api/items/37051/export?format=markdown","export_json":"/api/items/37051/export?format=json","diagnose":"/api/diagnose?url=https%3A//news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large"}},"digest":{"id":37051,"title":"苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路 - 富途牛牛","url":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","source":"富途牛牛","topic":"ai","published_at":"2026-07-14T23:29:18+00:00","excerpt":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。 $苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。 PrismML…","quality_bucket":"high","quality_reason":"High confidence: full text extraction produced 2295 characters.","reading_time_min":1,"cluster_id":1771651},"card":{"display_title":"苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路 - 富途牛牛","subtitle":"富途牛牛 · 2026-07-14","summary":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。 $苹果 (AAPL.US)$…","badges":["quality:high"],"links":{"read":"/item/37051","original":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","diagnose":"/api/diagnose?url=https%3A//news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large"},"quality_warning":null},"export":{"title":"苹果评估AI模型压缩技术：270亿参数大模型可直接运行于iPhone，为Siri升级铺路 - 富途牛牛","url":"https://news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","summary":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A.","source":"富途牛牛","date":"2026-07-14T23:29:18+00:00","content":"苹果正与初创公司PrismML展开早期洽谈，后者周二发布压缩模型，将54GB大模型压缩至不足4GB，令270亿参数大模型可以直接跑在iPhone 15或更新机型上。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\n$苹果 (AAPL.US)$ 正与硅谷初创公司PrismML展开早期洽谈，后者声称可将大型AI模型压缩至能在iPhone上本地运行。若技术验证通过，此举将强化苹果的隐私主张，并为其迟滞已久的Siri升级提供关键支撑。\nPrismML CEO表示，苹果已开始评估其技术。洽谈目前处于非常早期阶段，走向尚不明朗，但\"进展顺利\"。\n此次消息发布恰在苹果推出iOS 27公测版的次日——这是苹果对Siri进行大幅改版后向公众开放的首次广泛测试，旨在与OpenAI和Anthropic的AI助手展开竞争。\n对于苹果而言，将更多AI运算留在设备本地，意味着更低的响应延迟、更少的云计算成本，以及无需联网即可使用部分功能的能力——这些与其核心隐私定位高度契合。\nPrismML的公开发布，为普通用户和投资者提供了在实验室之外检验其技术声明的机会。Counterpoint的Pathak总结道：\n\"云端与设备端AI的组合，能够提供更完整、更高效、更注重隐私的AI体验——复杂任务交由云端处理，敏感、时延敏感及隐私相关的任务则在设备端执行。\"\n压缩技术突破：54GB模型缩至4GB以内\nPrismML由加州理工学院研究团队孵化而来，背后有Khosla Ventures支持。该公司周二公开发布了阿里巴巴开源模型Qwen的压缩版本，将约54GB的原始模型压缩至不足4GB，使全部270亿参数能够在iPhone 15或更新机型上直接运行。\nPrismML CEO Babak Hassibi向CNBC表示，公司通过大幅简化模型内部信息的存储方式实现压缩——将每个数值从16位降至仅1至3个可能值，从而显著削减存储和运行模型所需的内存。\n据该公司称，压缩后的模型内存占用减少10至15倍，响应速度提升6至8倍，能耗降低3至6倍。Hassibi坦承存在一定取舍：模型整体性能通常下降数个百分点，事实性记忆的衰减早于推理、数学和编程等能力。\n目前，PrismML免费发布了两个压缩版本，适配iPhone、MacBook及搭载英伟达芯片的PC。公司表示，谷歌的开源模型Gemma是下一个压缩目标，此后还将处理需要数据中心硬件才能运行的更大规模前沿模型。\n今年3月，该公司完成由Khosla Ventures领投的1625万美元种子轮融资，加州理工学院拥有底层专利并向其独家授权。\n苹果本地AI布局：隐私与效率的双重驱动\n苹果目前已在设备端本地运行部分AI功能，包括翻译、部分摘要生成及与个人信息密切相关的特性，较复杂的请求则路由至其私有云基础设施或外部模型。\nAsymco创始人Horace Dediu表示，苹果的目标很可能是将绝大多数日常Siri交互保留在设备端，仅将最高需求的任务交付云端处理。本地处理意味着更低延迟、更强隐私保护，以及潜在的更低授权和云计算成本。\nCreative Strategies总裁兼首席分析师Carolina Milanesi指出，更小的模型可让苹果将更多高需求功能移至iPhone本地，包括计算摄影、视频生成，以及依赖健康、药物等敏感数据的健康与健身工具。\"设备端能做的越多越好，\"她说。\n苹果在推进本地AI方面具备潜在优势——其芯片与软件协同设计，对AI在设备上的运行拥有更精密的控制权。\n分析师警示：规模化验证是关键门槛\n尽管技术指标亮眼，分析师普遍提示，PrismML的声明尚需在受控演示之外得到验证。\nCounterpoint Research研究总监Tarun Pathak表示，模型在长提示下的表现、多任务处理时的电池消耗，以及跨数百万次请求和数千种设备组合的可靠性，将是关键考量。他说：\n\"最终考验将是数百万次查询、数千种设备组合以及大规模稳健测试。\"\nIDC客户端处理器研究负责人Phil Solis则指出，功耗可能是最大的未知变量。一个足够强大、被频繁使用甚至在后台持续运行以执行智能体任务的模型，即便内存占用较低，也可能对手机电量造成显著消耗。\n对芯片需求的影响：需求转移而非消失\nPrismML的发布也触及了市场对AI效率提升能否最终压缩芯片需求这一持续争论。\n摩根士丹利估计，苹果在2027财年的每比特动态随机存取内存平均成本可能同比上涨约190%，NAND存储成本上涨约180%。该机构预计苹果将把iPhone 18同等起售机型的价格提高约200美元以保护利润率。\nPrismML表示，其压缩方案可使原本需要8块GPU运行的云端模型缩减至仅需1块，并让原本依赖服务器的模型迁移至手机和笔记本电脑。这可能降低单一AI任务所需的内存或算力，但并不必然导致整体芯片需求下滑。\nD.A. Davidson分析师Gil Luria表示，模型瘦身并不会消除对处理器或内存的需求，只是将更多芯片从数据中心转移至手机等终端设备。\"你仍然需要GPU，仍然需要内存，\"他说。\n他还补充，在单一设备上运行AI实际上可能比共享数据中心基础设施效率更低，因为手机芯片大多数时候处于闲置状态。此外，效率突破往往催生更多使用需求，而非带来支出下降。\n市场对\"AI所需内存少于预期\"的信号向来反应灵敏。今年3月，谷歌发布TurboQuant论文——涉及在不损害模型性能的前提下削减内存使用——美光科技股价随即大幅下跌，尽管此后有所回升。\n编辑/lambor","confidence":0.9,"diagnostics_url":"/api/diagnose?url=https%3A//news.futunn.com/post/76024040/apple-evaluates-ai-model-compression-technology-27-billion-parameter-large","quality_bucket":"high","failure_kind":"none","retryable":false,"quality_reason":"High confidence: full text extraction produced 2295 characters.","quality_profile":{"profile_version":"extraction_quality.v2","bucket":"high","confidence":0.9,"failure_kind":"none","retryable":false,"retry_after_attempts":0,"reason":"High confidence: full text extraction produced 2295 characters.","operator_guidance":{"severity":"ok","recommended_action":"trust_full_text","next_step":"Use the extracted full text as the primary article source.","operator_label":"Ready","can_retry":false,"can_use_summary":false,"diagnostics_required":false},"content_depth":{"contract_version":"content_depth.v1","category":"full_text","label":"Full text","has_full_text":true,"has_summary":true,"content_length":2295,"summary_length":2022,"usable_text_length":2295,"source_field":"content"},"legacy_collapsed":false,"signals":{"extract_state":"ok","extract_error":null,"extract_retries":0,"content_length":2295,"summary_length":2022}},"tags":[],"format_contract_version":"news_item_formats.v1"}}}