2026年7月7日,英特尔在北京举办“智能体PC应用分享会”。英特尔中国区技术部总经理高宇在主题演讲中,开口第一句就定下基调:“欢迎来到智能体PC的新时代!”

台下坐着的人除了AI爱好者、英特尔用户和媒体之外,还有许多AI行业的专家和开发者。最引人关注的是,包括Flowy、QClaw、remio、TRAE、DuMate、YOYO Claw以及Marvis在内的、桌面AI智能体赛道中跑得最快的一批软件开发商,几乎都来了。要知道,在三个月前,也就是今年4月,英特尔才第一次提出全新的“智能体PC”概念。在三个月后的这场沟通会上,这些人带着各自已经商业化落地的AI应用坐到了一起。
高宇在主题演讲中回顾了今年初以来AI行业发生的变化。他表示,从OpenClaw到Hermes Agent,再到国内一批商业版桌面AI智能体的发布,桌面AI智能体已经成为如今AI应用落地最热的方向之一。基于此,他认为现在的AI不再只是一个无所不知的Chatbot,也不是一个能力增强的个人助手,而是一个“为结果负责”“自主执行”“随时待命”的真正意义上的“智能体”。“范式,已经迁移了。”
混合AI部署 智能体PC让AI真正用得起来
把“智能体PC”讲清楚,得先把它和过去那类简单地“装”个大模型的PC区别开。高宇在2026年4月21日的媒体会上表示,英特尔提出的“智能体PC”,针对的是用户真实痛点,搭配一套完整的架构,远不止往机器里装个OpenClaw软件那么简单。英特尔如今的目标很明确,就是想借助智能体PC,加速其商业化,做出“人人可用,成本友好,安全可靠,场景丰富”的AI时代“新入口”。

英特尔这套架构被高宇拆成了“一个架构、三个聚焦、两个邀约”。一个架构指的是智能体PC的逻辑架构图,从思考、调度、执行、记忆和交互等五大方面来描述智能体PC应具有的核心模块。在这里,智能体PC没有停留在跑大模型的容器这个阶段,它进化成了以本地智能体为核心、能主动协助的数字分身。
三个聚焦指的是英特尔聚焦三点,一是通过混合AI部署方式解决Token费用和敏感信息保护的问题;二是通过模型路由的方式让端云切换更加智能和丝滑;三是通过不断繁荣的Skills生态创造更加场景化的工作流,解决用户的实际问题。其中,最要紧的两条是混合AI部署和繁荣Skills生态。而两个邀约则是拉上国内桌面AI智能体软件开发商和全球PC OEM厂商一起干。

对于混合AI部署,英特尔用一个智能体PC的“微笑曲线”来展开叙述。在智能体PC的“微笑曲线”图中,横坐标是模型在端和云之间的部署方式,纵坐标是系统总体拥有成本。曲线右端是重度依赖云端API的场景,这个场景下初期门槛低,可当任务变复杂,Token费用就是一道高墙,而且云端QoS和敏感信息保护难覆盖全场景。曲线的左端则是走纯本地部署路线,比如要部署200B及以上规模的模型,会撞上硬件成本的高墙,上万元的价格会把大部分用户挡在门外。因此,英特尔主张的是在曲线中央用“本地辅脑+云端主脑”的混合架构,把体验和成本同时按住。

这套架构底下是高宇反复强调的“能力基座”。按照英特尔的说法,智能体PC要实现“微笑曲线”,那么在混合AI部署时就要具备LLM(任务推理与执行)、ASR(语音识别)、OCR(文字识别)、TTS(语音合成)、CV/VLM(视觉理解)、Image Gen(图像生成)、Omni(全模态交互)七种本地AI关键能力。这七大能力覆盖AI交互的全流程,通过在本地稳定流畅运行,兼顾性能与数据可靠性,实现效率与成本的双重平衡。
仅把多种模型部署到本地还不够,因为模型多了,新的麻烦就来了。比如用户很难判断一个任务到底该本地跑还是该上云,每次手动切换、试错,成本不低。更重要的是,真要从端侧切到云端时,敏感信息怎么保护?模型路由能不能因人而异、适配不同人的习惯?这些都是摆在前面的实际痛点。

英特尔的解法是设计一套智能的模型路由方案——英特尔SuperClaw模型路由方案。该方案通过“任务拆分、端云两级决策、本地脱敏上云、结果校验重做、反馈闭环自进化”五大步骤,实现了本地与云端算力的智能、可靠调度,在确保数据不出端的前提下,保障任务执行的效率与交付。在现场的演示中,英特尔SuperClaw模型路由方案可以为用户节省43%的推理时间和69%的推理成本。可以说,这套方案帮助用户实现了性能和成本的双收益。

实现“微笑曲线”的另一个重要路径是通过创新的MoE专家卸载技术解决“内存墙”的问题。针对内存瓶颈,英特尔联合江波龙和群联电子等AI SSD厂商,通过MoE专家卸载技术将35B模型的内存占用节省约10 GB。根据英特尔的数据,通过MoE专家卸载技术,在桌面AI智能体常见的32K超长窗口场景下,内存节省超过30%,首Token性能损失小于10%,解码TPS几乎无损。目前这套方案已经在英特尔第三代酷睿Ultra平台上实现产品化落地。

落到具体硬件,高宇给了两个“参考答案”:酷睿Ultra 358H和酷睿Ultra 325处理器。酷睿Ultra 358H被他称为“全能之选”,拥有180 TOPS算力,可在本地流畅运行35B模型,32 GB内存下最高支持128K上下文(经优化可达256K),运行ASR模型只需61秒就可以处理完一小时的音频,运行OCR模型只需要7.9秒就可以“啃下”53页带复杂图表公式的PDF,运行VLM模型只需要0.4秒就能理解一张1024×1024分辨率的图片。
酷睿Ultra 325则是“平衡之选”,它运行35B MoE模型的性能达到酷睿Ultra 358H的70%以上,运行ASR模型的性能近乎对等,而且搭载这款处理器的电脑价格亲民,绝大部分PC厂商都将推出搭载酷睿Ultra 325处理器的机型。
一呼百应,英特尔带着合作伙伴跑出加速度
自今年4月份首次提出“智能体PC”概念以来,为了推动智能体PC持续演进,英特尔带着合作伙伴在三个月里重点做了三件事:全方位建设繁荣的AI Skills行业生态;开展线下沙龙,加速技术普及;开辟线上专区,打通体验闭环。

先说开发者社区。英特尔和魔搭社区共创了AI PC专区,把一站式Skill开发指南、技术干货和优秀案例集中放进去,同时又持续举办Skill作品大赛,把开发者社群盘活。对于线下沙龙,英特尔拉着一众桌面智能体ISV伙伴在各地举办开发者面对面活动,目标是帮开发者在两三个小时内“吃透”Skills。此外,英特尔还联合Marvis、TRAE和YOYO Claw等主流桌面AI智能体工具上线了“端侧AI Skills”和“英特尔Skill专区”,把高品质的端侧AI技能直接递到终端用户手里。

高宇给Skills打了一个形象的比方:“Skills是大模型工作的一本‘说明书’,基于Skills搭出来的工作流就是智能体PC上的应用软件。”英特尔在以开放的AI Skill生态为纽带,打造开箱即用的“甄选Skill”、面向开发者的“参考Skill”及共创的“社区Skill”,系统化打通从终端到云端的智能生产力链路。在这三件事上,英特尔实际上是一位组织者,把芯片、OEM、ISV、模型厂和开发者社区拧成了一股绳。
这根绳,伙伴们接得也很快。

腾讯旗下的Marvis与英特尔开展芯片级深度合作,其大模型端侧的推理性能得到显著提升。此外,Marvis产品负责人王秋阳表示,Marvis即将上线“本地隐私模式”,可实现文件零上传、断网可用。

深圳市星漪科技有限公司(Flowy)CEO祁国良在会上介绍,Flowy自研了Herdsman端侧推理引擎,在酷睿Ultra平台上把Qwen3.5的解码速度拉起来,32K长上下文的预填充时间大幅缩短。Flowy还和江波龙的AI SSD(搭载HLCache+iSA存储智能体推理框架)配合做MoE专家与KV缓存的智能卸载,而且群联的方案里也整合了Flowy AI来降低用户的使用门槛。

据QClaw资深产品经理孙桦阳介绍,QClaw深度接入了英特尔Skill专区的ASR、TTS、OCR-NPU以及OCR-VLM等本地能力,实现开箱即用,比如QClaw推出的“爆款操盘手”智能体不仅能自动抓热点、生图、写文案,还能自动排版发小红书。

remio则专注于办公智能体和个人上下文管理。据remio创始人、CEO汪源介绍,remio借助英特尔AI PC平台的NPU把语义索引和会议转写的速度提了上去,而且综合成本比云端低,还能实现数据不出本机。

字节跳动旗下的TRAE WORK通过内置Skill充分释放英特尔AI PC的本地算力,可实现零成本语音文字互转(ASR/TTS)、本地文生图、Windows系统本地操控及中英实时翻译,帮助用户打造高效、低Token消耗的本地AI办公体验。

百度旗下的DuMate与英特尔一起把智能体能力带到端侧,可本地部署35B大模型及PaddleOCR-VL多模态模型,为企业用户提供全程可审计的可靠保障。

另外,荣耀旗下的YOYO Claw则借英特尔端侧算力实现了Claw端云路由协同,全链路可省Token,YOYO Claw还率先把本地文生图、TTS、ASR、OCR以及游戏路书等技能整合了进来。
自今年4月英特尔首次提出“智能体PC”逻辑架构并倡导繁荣Skill生态以来,仅仅三个月,英特尔便携手广大软件生态伙伴,推动智能体PC从概念框架走向真实落地,带来丰富的落地应用,可见英特尔拥有强大的生态阵容。
真实场景落地 智能体PC走进真实日常
概念讲再多,最后也得回到日常。为了给用户带来真实、可感知的价值,让智能体PC不再只是概念,而是实实在在融入日常的智能体验。在活动现场,英特尔还与合作伙伴进行了一系列生动的应用演示,直观地展现了智能体PC如何高效重塑办公生产力、体育娱乐和游戏电竞、教育等真实世界的工作流,全面提升生产力与创造力。


在现场,知识工作者用remio把一堆访谈文档和录音批量导进去,本地NPU加速导入和语音转写。同时,remio还支持AI跨文档提问以及聚合出核心结论,并可一键导出填好的表格,而且全程数据不出本机,使用起来非常方便。
英特尔技术专家在现场展示了通过Marvis基于酷睿Ultra平台打造的智慧报销智能体。基于Marvis的本地隐私模式,这个智能体支持发票自动整理、全本地推理,实现报销流程自动化。

另外,现场还展示了一个基于OpenVINO和Omni全模态模型,面向学前儿童和亲子场景的学前启蒙智能体。这个智能体可通过摄像头实时识别多模态识字卡,支持流畅的语音对答与播报,而且数据全本地运行,守护隐私,适合趣味幼儿启蒙。此次活动现场还展示了利用QClaw智能体自动抓取热点、撰写文案、本地模型生图并排版发布的演示,以及在体育娱乐、游戏电竞和智慧教育等领域的实际应用场景。
写在最后
用高宇的话来说,如今AI正在推动个人计算从“工具增强”迈入“智能伙伴”新阶段。从提出“智能体PC”的概念到不断推动智能体PC生态落地,英特尔显然敏锐地抓住了时代的发展机遇。短短三个月时间,从一纸概念到如今20余项真实场景的落地,英特尔在这场智能体PC的变革中将芯片、OEM、ISV、模型厂商以及开发者全部聚在一起,为用户带来了更易用的混合AI功能与体验跃升,让智能体PC加速融入日常,覆盖个人、企业、行业、娱乐、游戏、家庭和汽车等多元场景。相信随着英特尔和生态伙伴的不断推进,不久后我们就能看到智能体PC惠及千家万户。


