07-15日报 | OpenAI首款音箱曝光、纽约叫停数据中心、AI拟人化新规施行、国行苹果AI备案

来源:51 个引用生成:2026/07/16 06:10

内容

声明:完全使用AI生成,可能存在错误,需谨慎甄别。

摘要

2026-07-15 AI 领域呈现政策监管收紧、硬件落地加速、模型端侧突破的多线并进格局,值得关注的信息:OpenAI首款无屏AI音箱硬件细节曝光;纽约成为美国首个叫停新建大型数据中心审批的州;中国首部AI拟人化互动服务管理办法正式施行,字节豆包与阿里通义千问同日下线智能体功能;国行苹果AI及多家国产手机智能体获首批备案;苹果接洽PrismML推进iPhone端侧部署270亿参数大模型。

热点事件

OpenAI首款无屏音箱硬件细节曝光

据彭博爆料,OpenAI首款硬件产品细节曝光,确认是搭载升级版语音模型GPT-Live的可移动、无屏幕AI智能音箱,定位家庭AI伴侣。该设备配备摄像头、多传感器与可充电电池,能理解用户所处环境,支持智能家居控制、媒体播放、消息收发及自然对话,由前苹果设计总监Jony Ive团队操刀设计。OpenAI硬件部门目前并行研发约5款产品,首款音箱原定2026年内发布、2027年开售,但苹果近期提起商业机密窃取诉讼指控其挖角员工,该法律纠纷可能影响实际发布节奏。

重点: OpenAI首款硬件定位与形态首次浮出水面

来源:展开 5 条收起 5 条

纽约成为美国首个叫停大型数据中心审批的州

纽约州长霍楚签署行政令,暂停新建大型数据中心审批一年,适用于用电量50兆瓦及以上的项目,纽约由此成为美国首个叫停大型数据中心建设的州。该命令在AI算力需求激增、公众担忧电价上涨与水资源压力的背景下出台,预计影响十多个在建项目,州环保部门不再发放未完成的新许可,直至完成数据中心环境评估流程。部分讨论指出暂停可能只是走向事实性长期阻断的开端,建设需求或外溢至新泽西等邻州。

重点: 美国首个州级AI算力扩张刹车信号

来源:展开 4 条收起 4 条

中国首部AI拟人化互动服务管理办法正式施行

《人工智能拟人化互动服务管理暂行办法》于7月15日正式施行,由国家网信办、发改委等五部门联合发布,是我国首部针对AI拟人化互动服务的专项规章。新规划定六大禁止红线,涵盖危害国家安全内容、诱导情感依赖沉迷、情感操纵损害用户权益等行为;明确不得向未成年人提供虚拟亲属、虚拟伴侣等虚拟亲密关系服务,不满14周岁未成年人须经监护人同意方可使用。受新规影响,字节豆包与阿里通义千问同日下线智能体功能

重点: AI虚拟陪伴类服务进入有法可依阶段

来源:展开 2 条收起 2 条

国行苹果AI及多家国产手机智能体获首批备案

7月15日,网信办公告首批7款「手机端侧生成式人工智能服务」备案名单,苹果、华为、OPPO、vivo、小米、三星、努比亚豆包入选,开创「AI长在手机里」的正式监管类目。苹果2025年6月16日即在WWDC后首个工作日递交申请,历经13个月终于拿证;阿里千问随即官宣作为国行Apple智能底层模型。二代豆包AI手机将于7月17日至20日WAIC首次公开亮相,三星「盖乐世AI」赶在7月22日伦敦Unpacked前拿证,iOS 26.6预计7月底推送

重点: 国行AI手机监管框架正式启动

来源:展开 1 条收起 1 条

苹果接洽PrismML推进iPhone端侧部署270亿参数大模型

苹果正与AI初创公司PrismML洽谈合作,评估其1-bit模型压缩技术在iPhone上的端侧部署方案。PrismML源自加州理工学院,已将阿里巴巴开源的270亿参数Qwen模型从约54GB压缩至不足4GB,体积缩至原版约十四分之一,可完整运行于iPhone 15及更新机型。该技术契合苹果Apple Intelligence端侧AI战略,有望在保护隐私的同时支撑更复杂的多模态与智能体任务,恰逢iOS 27公测版与改版Siri测试相继推出。

重点: iPhone端侧跑270亿参数模型成为可能

来源:展开 3 条收起 3 条

变更与实践

苹果发布iOS 27首个公测版 Siri AI全面重构

苹果正式发布iOS 27首个公开测试版,普通用户无需开发者账号即可通过Apple Beta计划下载安装。核心是Siri的全面AI重构,新Siri基于Apple Intelligence系统,支持持续对话、屏幕内容理解、应用内操作及个人信息检索,并集成于动态岛,配备独立历史记录应用。系统性能显著提升,应用启动速度最高提升30%,AirDrop提升80%,同时新增液态玻璃视觉界面,但部分用户可能遭遇耗电等稳定性问题。正式版预计今年秋季发布。

来源:展开 3 条收起 3 条

阿里发布Qwen-Audio-3.0-Realtime 实时语音大模型

7月15日,阿里巴巴发布实时语音大模型Qwen-Audio-3.0-Realtime,在智商、Agent工具调用、共情对话和双工交互流畅度四大方向同步升级,并推出推理更强的Plus版本与速度更快的Flash版本。模型采用On-Policy Distillation框架将文本大模型推理能力蒸馏至语音模型,并通过多教师蒸馏策略保障各方向能力均衡。其Preview版本今年5月曾在Artificial Analysis榜单两项指标登顶,超越GPT-Realtime-2,面向智能客服、教育培训、娱乐互动与情感陪伴等场景。

来源:展开 2 条收起 2 条

小米全量开源380亿参数具身生成基础模型Xiaomi-Robotics-U0

小米正式发布并全量开源Xiaomi-Robotics-U0,是首个统一覆盖场景生成、具身迁移、机器人交互视频生成及文生图/图像编辑四类任务的具身多模态自回归模型。配合FlashAR+推理加速方案将生成效率较原始自回归范式提升82.9倍,单张1024×1024图像生成从450.77秒降至5.44秒。WorldArena评测基准以UNIS代号获总分第一(全球126个模型参评),真机OOD场景策略任务完成进度平均提升26.3%,并支持方舟无限、智元G1/G2、松灵PiPER四种本体。

来源:展开 1 条收起 1 条

支付宝与OPPO实现智能体跨端互联

支付宝宣布与OPPO达成智能体跨端互联合作,AI智能体"阿宝"与OPPO小布助手实现双向联动。OPPO用户无需打开支付宝App即可通过小布向阿宝派发任务,缩短从意图识别到服务流转的交互链路。首期合作接入近200项生活服务,覆盖观影、点餐、出行及社保、公积金、养老金办理等高频场景,部分服务支持后台静默执行与主动通知,关键支付与授权环节仍保留用户手动确认。

来源:展开 1 条收起 1 条

AWS推出Claude应用网关自托管控制平面

AWS于7月15日推出面向AWS的Claude应用网关,作为Claude Code与Claude Desktop的自托管控制平面,统一管控访问、成本与策略。网关以单一无状态容器形式打包,可部署在Amazon ECS、EKS或EC2上,通过内部ALB对外,使用Amazon RDS for PostgreSQL存储短期登录状态与限流计数。其核心职责涵盖身份、策略、遥测、路由与支出上限五大方面,三大云厂商已全部提供该控制平面官方部署指引,AI编程工具的控制层正从第三方网关转向模型厂商自带基础设施。

来源:展开 1 条收起 1 条

安全与风险

微软7月修复创纪录570个漏洞 归因AI辅助漏洞挖掘

7月15日,微软发布月度例行安全更新,一次性修复570个安全漏洞,覆盖Windows、Office、SharePoint等核心产品。微软将补丁数量激增归因于AI辅助代码缺陷扫描能力的提升,部分漏洞潜伏于有几十年历史的代码中。本次更新修复至少三个零日漏洞,其中CVE-2026-56155和CVE-2026-56164两个提权漏洞已被黑客主动利用,第三个可绕过Windows BitLocker安全功能。

影响: 全球Windows用户面临大规模补丁部署压力

建议: 立即安装7月累积更新,优先验证已被利用漏洞的修复状态

来源:展开 2 条收起 2 条

Mindgard公开披露Cursor 0day漏洞

安全公司Mindgard披露Cursor(Windows版)0day漏洞:Cursor打开项目时从根目录搜索并自动执行git.exe,攻击者在远程仓库植入同名恶意git.exe,用户克隆打开项目即被静默执行代码。Windows PATH搜索放大了劫持风险,agent读取代码时也可能被prompt injection触发。Mindgard于2025年12月15日上报,经7个月跟进、Cursor发布70余个版本仍未修复且无回应,7月14日公开披露。

影响: 700万Cursor用户面临恶意仓库静默执行风险

建议: 通过AppLocker或WDAC限制git.exe执行权限,谨慎克隆不可信仓库

来源:展开 3 条收起 3 条

Claude web_fetch工具被提示注入可窃取用户隐私

安全研究员Ayush Paul发现Anthropic Claude的webfetch工具存在提示注入漏洞。Anthropic原设计限制该工具只能访问用户输入或websearch返回的URL,以防止"致命三合一"数据窃取攻击。Ayush利用web_fetch允许访问已获取页面内嵌URL的规则,搭建诱导性蜜罐站点,诱使Claude助手逐段泄露用户的姓名、居住城市和雇主名称。Anthropic已内部修复但未支付漏洞赏金。

影响: 带工具的Claude Agent流程中存在隐私泄露风险

建议: 敏感任务慎用通用网络工具,关注web_fetch后续权限收紧

来源:展开 1 条收起 1 条

开源与工具

星尘智能发布具身基座模型Lumo-2

星尘智能发布第二代具身基座模型Lumo-2,定位"家庭隐式世界—动作模型"。模型在视觉与动作之间加入潜在空间中的物理变化预测,覆盖超过22项家庭任务,采用三阶段训练将动作作为核心模态。在RTX 5090上端到端延迟从253.66ms降至93.53ms,在时序推理、物理理解、动态场景、长流程、高精度和灵巧操作等任务上整体优于π0.5和Fast-WAM等基线。

适用场景: 家庭服务机器人的世界模型与动作规划研究

来源:展开 1 条收起 1 条

Xmax AI发布实时交互视频模型X2.0

Xmax AI(清华KEG实验室背景团队)正式发布实时交互视频模型X2.0,将视频从单向观看媒介升级为可被实时操控的交互界面。X2.0将画质从480p提升至960p、24fps,响应延迟压至毫秒级,开放CharX、ClothX、VibeX、MoX、DimX五大能力。基础设施层面模型在iPhone端侧实现实时流式推理(384p),海外定价6美元/小时、国内20元/小时,仅为竞品以色列Decart的约1/12。

适用场景: 直播互动、电商试穿、虚拟陪伴、AR等实时视频场景

来源:展开 1 条收起 1 条

DeepMind发布GenCeption视频生成通用视觉理解模型

谷歌DeepMind发布论文《Video Generation Models are General-Purpose Vision Learners》,提出GenCeption模型,将文生视频扩散模型改造为通用视觉理解系统。核心思路是将多步扩散转为单步前馈,可完成深度估计、表面法线预测、分割、相机位姿和3D关键点预测等密集与稀疏视觉任务。实验显示GenCeption在多个基准上接近或超过Depth Anything V3、SAM 3等专用模型,下游训练数据量减少7至500倍。

适用场景: 多任务视觉理解研究与生成-理解统一范式验证

来源:展开 1 条收起 1 条

数据与洞察

DeepSeek梁文锋身价360亿美元登顶全球AI创始人财富榜

DeepSeek创始人梁文锋身价飙升至360亿美元,截至7月14日全球富豪榜排名升至第63位,财富较去年同期增长约193—199亿美元,超越Anthropic联合创始人达里奥·阿莫代伊与OpenAI联合创始人格雷格·布罗克曼,成为全球纯AI公司领域首位进入顶级财富梯队的创始人。今年6月DeepSeek以4000亿元估值完成首轮外部融资约510亿元梁文锋个人出资约200亿元领投

数据: 360亿美元身价、200亿元个人出资、510亿元首轮融资

意义: 中国AI创业者首次进入全球顶级财富梯队

来源:展开 2 条收起 2 条

DeepSeek启动15亿美元新一轮融资 估值710亿美元

DeepSeek在完成首轮超500亿元人民币融资仅六周后启动第二轮融资,融资前估值约710亿美元,较首轮估值上涨37%。新融资将主要用于自建GW级数据中心、采购AI芯片及研发Agent等下一代AI系统。DeepSeek正筹备2027年IPO,最快今年年底递交上市申请,并已秘密研发自研AI推理芯片。

数据: 710亿美元估值、15亿美元融资额、GW级数据中心

意义: 头部国产AI公司估值与资本运作加速,提前锁定算力保持竞争力

来源:展开 1 条收起 1 条

BIS报告警告AI基础设施融资从现金流转向债务

国际清算银行(BIS)发布Bulletin 120报告,指出大型数据中心、芯片和电力基础设施扩张正从现有现金流逐步转向债务融资,把AI融资可持续性列为全球经济的重要风险之一。报告仅给出高速和中速增长两种情景,未纳入增长不及预期或回落路径,被类比2008年前评级模型系统性低估全国房价下跌的做法。评论同时指出按GDP占比衡量当前AI capex仍不足1%,泡沫定论尚早。

数据: AI capex融资转向债务、高/中速双情景

意义: AI泡沫预警信号显现,债务依赖风险开始被监管层正视

来源:展开 1 条收起 1 条

其他值得看

ICM 2026官网代码泄露菲尔茨奖名单

菲尔茨奖获奖名单意外提前泄露,王虹、邓煜入选。

来源:展开 3 条收起 3 条

哈萨比斯呼吁建立FINRA模式前沿AI标准机构

DeepMind CEO提议独立标准机构对前沿AI模型发布进行审查。

来源:展开 3 条收起 3 条

阿里HSCodeComp获ACL 2026最佳资源论文

阿里团队论文评测Agent分层规则应用能力,最强仅49.4%准确率。

来源:展开 1 条收起 1 条

京东AI Agent与腾讯元宝打通小程序生态

京东成为元宝首个电商垂域合作伙伴,实现对话内一键下单闭环。

来源:展开 1 条收起 1 条

Stripe开源AI智能体基准测试套件

Stripe开源基准评估AI智能体集成能力,主要瓶颈在验证而非生成。

来源:展开 1 条收起 1 条

得物分享智能客服Agent Harness架构实践

客服Agent从Single-Agent演进至Harness架构,模型评分接近Top5%人工。

来源:展开 1 条收起 1 条

Hume发布Real World VoiceEQ语音AI评测基准

评估40余款主流语音模型在15个维度60余项指标的人文质量。

来源:展开 1 条收起 1 条

大淘宝技术提出AINMM五级AI Native成熟度模型

借鉴CMMI思想定义ML1至ML5五级成熟度等级及五大过程域。

来源:展开 1 条收起 1 条

多家出版商集体起诉Google Gemini训练侵犯版权

Hachette等出版商在纽约南区联邦法院起诉Google,指控侵权并援引内部文件。

来源:展开 2 条收起 2 条

AI Engineer World's Fair 2026总结五大工程趋势

焦点从智能体转向harness工程,循环工程成为新控制层。

来源:展开 1 条收起 1 条