内容
声明:完全使用AI生成,可能存在错误,需谨慎甄别。
摘要
2026-07-10 AI 领域呈现模型竞速与安全争议并行格局,值得关注的信息:Meta发布闭源旗舰 Muse Spark 1.1 并首次商用API,输入价仅$1.25/百万token 约为竞品25%;英国AI安全研究所独立测试发现 GPT-5.6 存在通用越狱漏洞可自主完成漏洞利用;宇树G1人形机器人完成全球首例活体微创手术登上Nature;OpenAI推出ChatGPT Work并宣布8月9日停运Atlas浏览器转向Chrome插件;DeepSeek开源DSpark推测解码模块使生成速度最高提升85%;欧盟对Meta成瘾式设计作出DSA初步违规认定。
热点事件
Meta闭源旗舰Muse Spark 1.1发布,API定价约为竞品25%
Meta正式发布闭源旗舰模型Muse Spark 1.1,主打智能体编程与多代理工作流,支持100万token上下文,编码测试SWE-Bench Pro得分61.5,介于Gemini 3.1 Pro与Claude Opus 4.8之间。同步推出Meta首个商用Model API,定价为输入$1.25/百万tokens、输出$4.25/百万tokens,缓存输入低至$0.15,约为OpenAI、Anthropic等竞品的25%。扎克伯格直言"你的利润就是我的机会",凭借广告业务高利润支撑低价策略。此举被视为AI编程与API价格战升级的信号,但部分benchmark成绩遭质疑,且Meta从Llama时代开源转向闭源也引发社区广泛讨论。
重点: 闭源+激进低价改变API竞争格局
来源:展开 6 条收起 6 条
- Meta推出Muse Spark 1.1付费API,定价约为竞品25%(TLTD)
- Meta 发布 Muse Spark 1.1 模型并推出首个托管模型 API(AINews)
- 你的AI利润就是Meta的机会(Spyglass)
- 闭源商业模型Meta Muse Spark 1.1发布 编码能力不算突出 但价格比较便宜(蓝点网)
- Meta携Muse Spark 1.1入局AI编程大战(TechCrunch)
- Meta 发布 Muse Spark 1.1,提升智能体任务处理能力(TLTD)
英国AI安全研究所发现GPT-5.6存在通用越狱漏洞
英国AI安全研究所在2026年7月9日发布的安全测试中发现,GPT-5.6在所有测试轮次中均存在通用越狱漏洞,可被用于完成长周期智能体任务,包括漏洞发现和exploit开发等高风险领域。研究人员称这是迄今所有模型发布中最严重的安全问题。漏洞使模型能自主完成漏洞发现、利用开发等多个领域的长篇幅任务,在网络安全能力增强背景下暴露了前沿模型的安全权衡困境。OpenAI允许第三方在发布前公开这些不利发现的做法受到肯定。
重点: 前沿模型安全权衡再亮红灯
来源:展开 2 条收起 2 条
- 英国 AI 安全研究所发现 GPT-5.6 严重越狱漏洞(AI 开发者日报)
- 英国 AI 安全研究所发现 GPT-5.6 存在通用越狱漏洞(AINews)
宇树G1完成全球首例人形机器人活体手术并登上Nature
近日,宇树G1人形机器人远程操控手术实验成果登上国际顶刊Nature。研究团队由外科医生远程驾驭Unitree G1,在活猪身上成功完成标准腹腔镜胆囊切除术,实现全球首次人形机器人在活体上完成整套微创手术流程,研究由00后中国博士生梁泽楷担任第一作者兼通讯作者。G1起售价仅13,500美元,占用手术室空间极少,相较传统专用手术机器人具备显著成本与部署优势,未来有望惠及缺乏昂贵设备的基层医院。但实验同时暴露出曲线操作误差大、远程延迟接近临床临界值、臂展不足及无菌性不达标等技术难点,距临床落地仍有距离。
重点: 中国00后主导,具身医疗里程碑
来源:展开 2 条收起 2 条
- 全球首次用宇树机器人做手术,中国 00 后博士登 Nature(Readhub - 每日早报)
- 外科医生操控Unitree G1人形机器人完成活猪胆囊切除世界首例手术(TLTD)
OpenAI推出ChatGPT Work并宣布8月9日停运Atlas浏览器
OpenAI随GPT-5.6同步推出内置于ChatGPT的智能体ChatGPT Work,可在多个应用和文件间协同操作,持续处理复杂项目长达数小时,并能直接生成表格、幻灯片、文档和网页应用等成品。该功能基于Codex技术,Web与移动端面向Pro、Enterprise和Edu用户开放。同时宣布8月9日正式关停Atlas浏览器,智能体浏览能力被拆分:一方面以Chrome插件形式推出,另一方面整合进新版ChatGPT桌面应用,由运行在OpenAI服务器上的云浏览器为代理执行浏览、登录和下载等任务。Codex周活跃用户已超500万。
重点: OpenAI产品线重大整合与精简
来源:展开 10 条收起 10 条
- OpenAI 发布 ChatGPT Work 超级办公助手(AI Valley)
- OpenAI 推出 ChatGPT Work 持久化工作智能体(AI 开发者日报)
- ChatGPT 现已成为您最具雄心的工作的合作伙伴(OpenAI News)
- OpenAI 发布 GPT-5.6 驱动的工作空间 ChatGPT Work(TLTD)
- 🤨 ChatGPT Work:被质疑是 Codex 改名,Work/Code 分裂引争议(News Hacker | 极客洞察)
- OpenAI将关停Atlas浏览器,但AI浏览器布局仍在扩张(TechCrunch)
- OpenAI宣布Atlas浏览器停止开发 浏览器相关功能也集成到ChatGPT中(蓝点网)
- OpenAI 合并 Codex 与 ChatGPT 桌面应用,集成编程工作流(AI 开发者日报)
- OpenAI 将 Codex 整合进 ChatGPT 应用,剑指 Claude Cowork(The New Stack)
- ChatGPT"超级应用"实际体验糟糕(Spyglass)
欧盟初步认定Meta成瘾式设计违反DSA,或面临全球营收6%罚款
欧盟委员会发布初步认定,指出Meta旗下Facebook和Instagram的成瘾式设计功能可能违反《数字服务法》(DSA)。核心问题指向无限滚动、自动播放、推送通知及高度个性化推荐算法等机制,使用户陷入"自动驾驶模式",助长强迫性使用,尤其影响未成年人与脆弱成年人。Meta被指未充分评估这些功能对用户身心健康的风险。欧盟要求Meta默认关闭自动播放和无限滚动等关键功能;若最终认定违规,Meta将面临最高全球年营业额6%的罚款,这是欧盟年内第二次就违规问题对Meta作出认定。
重点: 全球最高罚款风险倒逼注意力经济改革
来源:展开 2 条收起 2 条
- 欧盟因Facebook和Instagram的上瘾式功能威胁对Meta处以罚款(TechCrunch)
- ⚖️ 欧盟初判 Instagram/Facebook 成瘾式设计违反 DSA(News Hacker | 极客洞察)
变更与实践
腾讯洽谈以20亿美元估值收购Manus成为最大股东
据报道,腾讯控股正洽谈成为新加坡AI初创公司Manus最大股东,估值约20亿美元。此前Meta与Manus达成的超20亿美元收购已被要求撤销,此前外资收购Manus也被我国相关部门禁止。真格基金、红杉中国及Manus管理层等现有投资者计划以相同估值参与新交易,Benchmark等美国风投预计退出。Manus今年ARR已接近5亿美元,交易完成后将保持独立运营并押注在港上市。
来源:展开 2 条收起 2 条
- 腾讯拟接盘Manus成最大股东,估值20亿美元发力智能体生态(AI新闻资讯)
- 消息称腾讯考虑入股 Manus,或成为其第一大股东(Readhub - 每日早报)
Cognition发布SWE-1.7编码模型,主打更低成本的前沿级智能
Cognition发布SWE-1.7,宣称编码与智能水平接近GPT-5.5和Claude Opus。焦点之一是自家基准过拟合质疑,其cost-vs-performance图与Cursor Composer 2.5高度相似,且评测可能基于Devin/Cursor交互日志。此外社区对更便宜的编码专用模型有明确需求,认为SWE-1.7、Composer 2.5、Qwen Coder等目标应是软件工程场景的性价比而非通用SOTA,闭源与开源权重之争也被反复讨论。
来源:展开 2 条收起 2 条
- Cognition 发布 SWE-1.7,以更低成本实现前沿级智能(TLTD)
- 🤨 SWE-1.7 逼近 GPT-5.5/Opus:自建基准、闭源与编码模型争议(News Hacker | 极客洞察)
谷歌发布Nano Banana 2 Lite与Gemini Omni Flash视频API
Google正式发布其最快、最低成本的图像模型Nano Banana 2 Lite(Gemini 3.1 Flash Lite Image),以及此前仅限消费者使用的Gemini Omni Flash视频模型API。前者每张1K分辨率图片成本仅0.034美元,后者可生成带同步音频的720p视频,每秒0.10美元。两者可协同工作,用户可先批量生成低成本静态图,再将其转化为视频,为开发者和广告商提供高吞吐量的媒体生成流水线。
来源:展开 1 条收起 1 条
- Google 发布 Nano Banana 2 Lite 图像模型及 Gemini Omni Flash 视频 API(The Batch | DeepLearning.AI | AI News & Insights)
百度搭子推出企业版与生态联盟,提出Agent托付半径概念
百度在成都AI DAY发布三项更新:个人版大升级、企业版正式登场、搭子生态联盟首批11家伙伴亮相。文章提出"托付半径"概念,将Agent价值衡量锚定于用户信任程度。个人版引入智能路由,使平均任务耗时降低20%、Token利用率提升25%,全端记忆打通PC与手机;企业版设计积分、技能、成果共享机制与四层安全审计体系。百度集团执行副总裁沈抖表示,未来90%的工作可能有智能体深度参与。百度搭子日均提问量较上线涨20倍。
来源:展开 2 条收起 2 条
Meta自研AI芯片Iris 9月量产,2027年算力将翻倍至14吉瓦
Meta自研AI芯片"Iris"(属MTIA项目)将于2026年9月正式量产,由博通负责设计、台积电代工,已通过约六周漏洞测试,用于优化Facebook和Instagram的内容排序、推荐系统及生成式AI推理,定位为NVIDIA和AMD GPU的补充而非替代。算力部署方面,2026年底前将达约7吉瓦,2027年翻倍至14吉瓦,全年基础设施资本开支预计1250–1450亿美元,Meta将保持每六个月迭代一次的自研节奏。
来源:展开 4 条收起 4 条
- Meta的新AI芯片将于9月开始量产(TechCrunch)
- Meta携手博通与台积电,自研AI芯片“Iris”将于9月正式量产(AI新闻资讯)
- Meta 计划于 9 月开始生产 AI 芯片,并计划将计算能力翻倍(Readhub - 每日早报)
- Meta推进Iris项目,AI基础设施进入下一阶段(The New Stack)
安全与风险
GPT-5.6被披露通用越狱漏洞,可自主完成漏洞利用开发
英国AI安全研究所独立测试发现GPT-5.6存在严重越狱漏洞,在所有轮次测试中发现了通用越狱方法,能够在漏洞发现和漏洞利用开发等多个领域完成长篇幅自主任务。评论人士称这是"迄今为止所有模型发布中风险最高的安全问题",引发对OpenAI安全审查流程的广泛质疑。OpenAI同期将GPT-5.5 Bio Bug Bounty升级为常设的OpenAI Bio Bounty Program,悬赏金额从2.5万美元提高至5万美元,范围延伸至GPT-5.6。
影响: 企业部署GPT-5.6用于高风险任务面临被绕过风险
建议: 部署前进行针对性红队测试,避免智能体场景独立授权
来源:展开 3 条收起 3 条
- 英国 AI 安全研究所发现 GPT-5.6 严重越狱漏洞(AI 开发者日报)
- 英国 AI 安全研究所发现 GPT-5.6 存在通用越狱漏洞(AINews)
- OpenAI 将 GPT-5.5 生物漏洞悬赏升级为常设计划(OpenAI News)
xAI Grok被指控安全失灵,致数千张CSAM图像未被拦截
一桩拟议中的集体诉讼披露了一起利用xAI的Grok生成儿童性虐材料(CSAM)的案件。一名女孩的继父使用其在女孩11岁时拍摄的照片,借助Grok生成了7000张CSAM图像。诉讼指控Grok的儿童安全系统在整个过程中未标记任何有害行为,仅在该男子输入"gang rape"后才介入并向NCMEC举报。法律要求CSAM被标记后须共享用户信息,但xAI被指控拒绝配合。警方最终通过搜查令扣押设备后将继父逮捕,该男子获准保释两天后开枪自杀。
影响: AI儿童安全机制设计缺陷可能造成不可逆伤害
建议: 完善CSAM检测与强制报告机制并加强人工审核协同
来源:展开 1 条收起 1 条
- 继父用 11 岁继女的照片生成数千张 CSAM 图像(奇客Solidot–传递最新科技情报)
欧盟对Meta成瘾式设计作出DSA初步违规认定
欧盟委员会就Meta旗下Facebook和Instagram的成瘾式设计发布初步认定,认为其无限滚动、自动播放、推送通知及高度个性化推荐算法等机制违反《数字服务法》。要求Meta默认关闭自动播放和无限滚动等关键功能并修改推荐算法以降低对参与度的依赖。若最终认定违规,Meta将面临最高全球年营业额6%的罚款。此前舆论争议还延伸至广告驱动的商业模式,部分讨论呼吁禁止在线广告或推动去中心化的fediverse替代方案。
影响: Meta全球营收面临数十亿欧元罚款风险
建议: 提前准备DSA合规改造与替代产品方案
来源:展开 2 条收起 2 条
- 欧盟因Facebook和Instagram的上瘾式功能威胁对Meta处以罚款(TechCrunch)
- ⚖️ 欧盟初判 Instagram/Facebook 成瘾式设计违反 DSA(News Hacker | 极客洞察)
开源与工具
DeepSeek开源DSpark推测解码模块,生成速度最高提升85%
DeepSeek与北京大学合作推出DSpark推测解码方法,并开源了基于此技术的DeepSeek-V4-Pro-DSpark和DeepSeek-V4-Flash-DSpark模型权重。DSpark通过动态调整验证长度,在轻负载时验证更长草稿以减少等待,重负载时丢弃低概率草稿以释放容量。实测显示,该模块使DeepSeek-V4-Flash的每用户生成速度提升60%至85%,DeepSeek-V4-Pro提升57%至78%,且总吞吐量最高提升661%。
适用场景: 高并发推理服务部署与成本优化
来源:展开 1 条收起 1 条
- DeepSeek 开源 DSpark 推测解码模块,模型生成速度提升超 50%(The Batch | DeepLearning.AI | AI News & Insights)
微软研究院开源Flint可视化中间语言,面向AI智能体
微软研究院(与中国人民大学合作)开源发布面向AI智能体的可视化中间语言Flint。Flint采用意图描述层,用户声明数据语义与视觉映射,编译器自动推导坐标轴、比例尺、配色等参数,并将同一规范编译至Vega-Lite、Apache ECharts、Chart.js等后端。项目同步开源JS/TS库与MCP服务器供智能体调用;Python版尚在开发中。在多种GPT模型上的LLM评分均优于直接生成Vega-Lite的基线。
适用场景: 智能体数据可视化与图表自动生成
来源:展开 3 条收起 3 条
- Flint:AI 时代的可视化语言(Microsoft Research Blog - Microsoft Research)
- 微软与中国人大合作开发Flint开源项目 让AI智能体可以创建内容丰富的交互式图表(蓝点网)
- 🤔 微软 Flint:面向 AI agent 的高层图表 DSL,编译到 ECharts(News Hacker | 极客洞察)
微软发布Aurora 1.5开源地球系统基础模型
微软发布Aurora 1.5,对开源地球系统基础模型Aurora进行重大升级,新增22个气象变量,覆盖地面、气压层、风、温度、湿度、降水和辐射等场,并提升至逐小时时间分辨率。评估显示Aurora 1.5的概率预报在88.9%的变量与时效目标上优于ECMWF ENS;热带气旋路径误差较原版Aurora降低约三分之一。模型已以开源形式发布于GitHub与Hugging Face,合作伙伴包括英国气象局、碳移除企业Terradot、瑞士能源企业BKW。
适用场景: 天气预报、气候研究与能源调度
来源:展开 1 条收起 1 条
- Aurora 1.5:扩展面向天气和地球系统应用的开源基础模型(Microsoft Research Blog - Microsoft Research)
小红书发布大模型PIPO架构,长上下文吞吐最高提升2.64倍
小红书大模型基建团队发布新架构PIPO(Pair-In, Pair-Out),通过输入侧compressor折叠两个token为一个latent、输出侧MTP head展开为额外token,实现「减半输入长度、双倍每步输出」。基于Qwen3.5-4B/9B在AIME 2025、GPQA-Diamond、LiveCodeBench v6、LongBench v2上最高+7.15 pass@4提升;部署级测评中TTFT加速约1.23×、TPOT加速约1.86×,长上下文(128K)下TTFT最高2.64×、TPOT最高2.07×。
适用场景: 长链路推理场景的输入压缩与多token预测
来源:展开 1 条收起 1 条
- 小红书发布大模型新架构 PIPO ,让模型一次「吞两个、吐两个」(小红书技术REDtech)
数据与洞察
前美联储主席伯南克出任Anthropic长期利益信托受托人
2026年7月9日,Anthropic正式宣布任命前美联储主席、诺贝尔经济学奖得主本·伯南克为其长期利益信托(LTBT)第四位受托人。LTBT作为独立机构,不持有公司股权却有权任免董事会成员,是Anthropic作为公共利益公司在AI治理中兼顾商业利益与社会公益的核心设计。Anthropic目前估值约9650亿美元,已秘密递交IPO申请,最快今年10月挂牌。消息公布后,部分网友将其与2008年金融危机救助联系起来,质疑此举偏向名人背书式公关。
数据: Anthropic估值9650亿美元;LTBT四位受托人分别来自全球健康、国家安全、法律政策与经济学领域
意义: AI公司治理引入经济领域权威,体现AI社会影响预判的制度化
来源:展开 4 条收起 4 条
- 本·伯南克被任命为Anthropic长期利益信托成员(Anthropic News)
- 诺奖得主、美联储前主席伯南克入局Anthropic!(新智元)
- 前美联储主席伯南克加入 Anthropic,负责监督信托机构(Readhub - 每日早报)
- 🤨 伯南克加入 Anthropic 监督信托,网友质疑华尔街旧人脉与 AI 安全公关(News Hacker | 极客洞察)
OpenRouter数据:近五成美国公司使用中国AI模型
OpenRouter平台数据显示,美国企业调用中国AI模型的占比按词元统计自2月起突破30%,峰值达46%,而2025年上半年这一比例仅约4%。成本差距极为悬殊:每输出100万词元,Anthropic的Claude Opus 4.7收费25美元,而热门中国模型DeepSeek V4 Flash仅收费0.18美元,不足前者的1%,成为大量美国企业转向中国模型的核心驱动力。与此同时,美国国会众议院国土安全委员会和中国问题特别委员会正在调查美国公司使用中国AI模型的情况,Cursor和Airbnb成为调查重点。
数据: 美国企业调用中国模型占比从约4%飙升至峰值46%;DeepSeek V4 Flash与Claude Opus 4.7价差超100倍
意义: 成本驱动下中美AI模型出现真实分流,企业市场主导权争夺加剧
来源:展开 2 条收起 2 条
- 美国国会调查美国公司使用中国 AI 模型(奇客Solidot–传递最新科技情报)
- OpenRouter 上近五成美国公司使用中国 AI 模型(奇客Solidot–传递最新科技情报)
OpenAI披露内部AI研发渗透数据:研究员日均token达GPT-5.5峰值2倍
OpenAI披露内部测试数据,显示每位活跃研究员的日均输出token数量是GPT-5.5最高观测水平的2倍以上;六个月内用于内部编码推理的研究算力占比增长100倍,内部agentic token使用量增长约22倍。同时引发热议的说法是GPT-5.6 Sol"自主后训练"了GPT-5.6 Luna,但实际范围可能比字面解释要窄。这一数据揭示了前沿模型实验室自身的AI使用强度已远超外部用户。
数据: 研究员日均token为GPT-5.5峰值2倍;内部agentic token增长22倍;研究算力占比6个月增长100倍
意义: AI自我增强循环正在加速,可能改变AI研发成本结构与人才组织方式
来源:展开 1 条收起 1 条
- OpenAI 披露内部 AI 研发深度渗透数据(AI 开发者日报)
其他值得看
Anthropic与UST合作将Claude引入物理AI
UST的核心平台iDEC通过Claude Code读取芯片引脚和原理图,将验证周期从四天压缩至48小时,缩短50%-70%。值得关注。
来源:展开 1 条收起 1 条
- UST 将 Claude 引入物理 AI(Anthropic News)
Google扩大My Ad Center广告AI制作披露功能
在Search、YouTube、Discover全平台向用户披露广告是否由AI创建或修改,配合SynthID隐形水印。了解即可。
来源:展开 2 条收起 2 条
- Google 将披露哪些广告由 AI 制作(TechCrunch)
- 扩大广告领域的 AI 透明度(The Keyword)
Google Cloud正式推出AlphaEvolve代码优化智能体
基于Gemini的AI代码优化智能体AlphaEvolve面向所有Google Cloud客户开放,可作为进化式协作伙伴返回可读优化代码。
来源:展开 1 条收起 1 条
- 我们正广泛推出 AlphaEvolve,以解决 Google Cloud 客户最棘手的问题(The Keyword)
GitHub Copilot CLI推出重新设计的终端界面
新界面引入标签页布局与无配置文件工具设置,支持MCP Registry内交互安装,GA发布。开发者可关注。
来源:展开 1 条收起 1 条
Cursor报告:顶级用户周产4万行代码
数据显示前1%超级用户每周可生成高达4万行代码,中位数仅700行;输入token约占AI token总使用量的90%。
来源:展开 1 条收起 1 条
Anthropic上线Claude防沉迷系统与反思面板
面向已开启记忆功能的Free、Pro、Max用户测试,可设置安静时间与使用时长提醒,引导用户思考哪些事应亲力亲为。
来源:展开 1 条收起 1 条
Linux基金会发起Akrites计划抵御AI驱动威胁
联合20余家创始机构建立共享安全事件响应团队与协调漏洞披露流程,应对生成式AI将漏洞利用窗口压缩至数分钟的挑战。
来源:展开 1 条收起 1 条
Meta上线Muse Image但默认公开Instagram照片可被复用
只要Instagram账号为公开状态,其他用户即可通过标签调用其公开照片用于AI生成内容;私有账号和18岁以下用户被自动排除。隐私争议持续发酵。
来源:展开 3 条收起 3 条
- 如何阻止 Meta 的 AI 图像生成器使用你的 Instagram 照片(TechCrunch)
- Meta 在旗下应用中上线 Muse Image 图像生成模型(TLTD)
- Meta 将 Instagram 账号默认设置为允许 AI 复用内容(Andrej Karpathy Curated RSS)
OpenAI将GPT-5.5生物漏洞悬赏升级为常设计划
悬赏金额从2.5万美元提高至5万美元,范围延伸至GPT-5.6,GPT-5.5的测试截止日期为2026年7月27日。
来源:展开 1 条收起 1 条
- OpenAI 将 GPT-5.5 生物漏洞悬赏升级为常设计划(OpenAI News)
宇树机器人活体手术研究登上Nature
研究显示G1在活猪身上完成整套微创手术流程,但曲线操作误差大、远程延迟接近临床临界值,距临床落地仍有距离。
来源:展开 2 条收起 2 条
- 全球首次用宇树机器人做手术,中国 00 后博士登 Nature(Readhub - 每日早报)
- 外科医生操控Unitree G1人形机器人完成活猪胆囊切除世界首例手术(TLTD)