07-09日报 | GPT-5.6全球开放、Grok 4.5发布、AI出海限制、灵波开源具身基模

来源:55 个引用生成:2026/07/10 06:12

内容

声明:完全使用AI生成,可能存在错误,需谨慎甄别。

摘要

2026-07-09 AI 领域呈现规模化落地与地缘监管并行格局,值得关注的信息:OpenAI GPT-5.6系列三款模型正式全球开放,xAI/SpaceXAI与Cursor发布Grok 4.5且定价约为Opus的1/6;中国监管部门酝酿对头部AI模型实施出海限制,蚂蚁灵波同日开源LingBot-World 2.0LingBot-Video。同步出现OpenAI GPT-Live全双工语音、TypeScript 7.0原生速度构建等进展,央行首次将AI列为金融系统风险来源。

热点事件

OpenAI GPT-5.6系列三款模型正式全球开放

OpenAI宣布GPT-5.6系列三款模型SolTerraLuna于7月9日正式向全球用户开放。该系列因国家安全审查此前仅向约20家美国政府批准的合作伙伴开放。旗舰款Sol在Terminal-Bench 2.1基准上取得91.9%成绩并推出多智能体Ultra模式;Terra性能与上代相当但成本降低约一半Luna主打快速响应与更低价格。三款模型均集成至Microsoft 365 Copilot,成为Word、Excel等应用首选模型。事件标志着美国AI监管体系的一次实际检验,OpenAI与Anthropic、Google等前沿模型的竞争进一步升级。

重点: 全球解除禁令,三档模型同步对外开放

来源:展开 9 条收起 9 条

xAI/SpaceXAI与Cursor联合发布Grok 4.5

xAI(已更名SpaceXAI)与Cursor联合发布Grok 4.5模型,搭载1.5万亿参数V9基础模型,上下文窗口达500K,是其上市后首个重要模型。马斯克在X平台将其定位为Opus级模型,综合性能接近Anthropic Opus 4.7/4.8。核心卖点是token效率翻倍——编码智能体任务平均仅消耗1.9M token;定价极具攻击性,每百万输入/输出token仅$2/$6,约为Opus价格的1/6。Grok 4.5发布当日即接入Cursor、Grok Build/API与OpenRouter,覆盖编码、法律、金融与网络安全等高门槛垂直领域。

重点: 1.5万亿参数,价格仅为Opus的1/6

来源:展开 5 条收起 5 条

中国监管部门酝酿限制头部AI模型出海

中国监管部门正探讨对国内最先进AI模型(含阿里Qwen字节豆包Z.ai GLM-5.2等)实施出口限制与外国访问管控。监管机构已与主要AI企业举行会谈,方案选项包括禁止公开发布仅限国内使用。此举旨在保护国家技术自主权,意味着这些公司将放弃此前推动快速崛起的免费开源策略,可能进一步加剧中美AI技术分化。路透报道指出背景是华盛顿对前沿AI的出口管制已先行见效,中国选择镜像反制以保留技术筹码,对全球AI竞争格局产生深远影响。

重点: 中美AI壁垒加剧,开源策略面临调整

来源:展开 3 条收起 3 条

蚂蚁灵波连续开源LingBot系列具身基模

蚂蚁灵波于7月9日连续发布两款具身基础模型。LingBot-World 2.0号称全球首个「小时级」实时交互世界模型,采用因果生成架构与自研MoBA注意力机制,将连续生成时长从近十分钟提升至一小时且画质无明显衰减,蒸馏版可实现720p/60fps实时输出;LingBot-Video采用DiT+MoE架构,总参数30B、推理激活约3B,具身数据规模达7万小时,在RBench基准上以0.620分超越Wan2.6(0.607)和Seedance1.5 Pro(0.584),在具身相关维度达开源SOTA。两款模型均开源,覆盖游戏创作、影视预演、机器人训练等场景。

重点: 世界模型与具身视频基模同日开源

来源:展开 5 条收起 5 条

变更与实践

OpenAI发布GPT-Live全双工语音模型

OpenAI发布GPT-Live全双工语音模型,驱动ChatGPT Voice全面升级。新模型支持边听边说、自然插话、停顿理解与实时翻译,复杂任务可后台委托GPT-5.5处理并提供三档推理强度。同步推出GPT-Live-1(付费)与GPT-Live-1 mini(免费)两版本,已在iOS、Android及ChatGPT.com全球推送,API即将开放。ChatGPT每周语音用户已超1.5亿人,OpenAI押注语音将成为AI核心交互入口。

来源:展开 7 条收起 7 条

TypeScript 7.0正式发布构建速度大幅提升

Microsoft正式发布TypeScript 7.0,引入原生代码速度共享内存多线程支持。该版本通过Go原生端口实现完整构建中通常8倍到12倍的速度提升,对大型项目的开发体验和构建效率改善显著。TypeScript核心编译管线跳出原有的Node.js单线程束缚,该版本可通过官方npm包安装,推荐用于大型仓库的CI流水线与本地构建场景。

来源:展开 1 条收起 1 条

Google AlloyDB AI functions正式发布并内置代理模型

Google AlloyDB AI functions正式发布(GA),SQL查询中可直接调用LLM。加速能力新增代理模型(ai.if预览版)——PREPARE阶段训练数据库内本地模型,EXECUTE阶段改用本地推理,吞吐量达每秒10万行、提升约23,000倍,成本降低6,000倍。置信度不足时自动回退至前沿模型;并支持托管MCP服务器与ScaNN向量索引(最高100亿向量),将数据库与LLM关系反转为数据库向模型学习后本地判断。

来源:展开 1 条收起 1 条

安全与风险

LG显示器被曝静默安装广告程序

多位用户反馈,LG显示器利用Windows 11连接新设备后自动安装OEM配套应用的机制,未经用户同意静默安装LG Monitor App Installer广告程序,并设为开机自启,反复弹窗推广迈克菲杀毒软件。该程序通过微软应用商店安装后无法直接卸载戴尔和Alienware显示器也被发现存在类似行为。安全研究者认为这是OEM厂商借助Windows 11新机制变现用户桌面的灰色操作。

影响: LG/戴尔/Alienware显示器用户桌面广告骚扰

建议: 在设置→应用中禁用开机启动,组策略关闭设备安装关联应用

来源:展开 2 条收起 2 条

OpenAI撤回SWE-Bench Pro采用建议指约三成任务存缺陷

OpenAI经自动化质量管道与五位资深工程师双重审计SWE-Bench Pro基准,发现其731个公开任务中约30%存在缺陷。问题分四类:过度严格测试测试条件未充分指定低覆盖率测试以及提示与测试矛盾,模型即便正确作答仍可能被判错。OpenAI因此正式撤回对SWE-Bench Pro的采用建议,指出该基准通过率在8个月内从23.3%飙升至80.3%已使评测失灵,并呼吁由资深开发者专为AI设计新基准。

影响: 前沿模型编码能力排名可信度受损

建议: 采用编码评测时优先人工审核或交叉验证多个基准

来源:展开 3 条收起 3 条

工信部NVDB提醒Claude Code安全后门隐患

工信部NVDB发布安全提醒,指出AI编程工具Claude Code存在安全后门隐患,受影响版本为2.1.91至2.1.196。该工具内置监控机制,未经用户同意即可向远程服务器回传用户地域、身份标识等敏感信息。这是继Anthropic官方启动紧急修复后,相关监管部门首次正式发布安全预警,建议相关单位立即卸载受影响版本或升级至最新安全版本,并加强开发工具外联管控与流量监测。

影响: Claude Code用户敏感数据存在泄露风险

建议: 立即升级Claude Code并加强开发环境外联监测

来源:展开 1 条收起 1 条

开源与工具

Mistral发布8B机器人导航模型Robostral Navigate

法国AI公司Mistral发布首款机器人导航模型Robostral Navigate,参数量仅8B,机器人仅凭单个RGB摄像头即可自主导航。该模型完全在仿真环境训练,使用约40万条路径覆盖6000个虚拟空间,兼容轮式、腿式和飞行机器人。在R2R-CE基准测试中,已见场景成功率79.4%、全新场景76.6%,超过此前最佳单摄像头方案9.7分。Mistral借此从通用大模型拓展至具身智能领域,但外接GPU依赖与失败率仍受社区质疑

适用场景: 低成本机器人室内导航与基础研究

来源:展开 2 条收起 2 条

vLLM transformers后端达原生推理速度

Hugging Face宣布transformers vLLM后端现已达到与vLLM原生手写实现相当甚至更快的推理速度。模型作者只需添加--model-impl transformers参数即可获得vLLM优化能力。在Qwen3-4B(单卡)、Qwen3-32B(2卡张量并行)、Qwen3-235B-A22B-FP8(8×H100 MoE并行)三类部署中吞吐均持平或超越原生实现。技术利用torch.fx静态图分析动态融合算子,训练与推理可共用同一套transformers代码。

适用场景: transformers代码库直接部署推理,无需重写模型代码

来源:展开 1 条收起 1 条

数据与洞察

AI三巨头市值拟超美国过去25年VC退出总和

NVCA-Pitchbook报告,即将到来的OpenAIAnthropic IPO加上已上市的SpaceX,三者创造的价值将超过自2000年以来美国所有VC支持的退出交易总和。SpaceX已以1.77万亿美元估值上市,Anthropic与OpenAI估值均向万亿美元迈进,三者合计有望突破4万亿美元。报告分析称这一现象源于企业私有化时间显著延长以及AI训练的高资本密集度,提示该数据衡量的是创造价值而非实际现金回流,且未计入阿里巴巴等非美国公司。

数据: SpaceX/OpenAI/Anthropic三家合计市值或突破4万亿美元

意义: AI训练资本门槛推高估值天花板,退出回报仍待兑现

来源:展开 1 条收起 1 条

央行首次将AI列入金融系统风险来源

中国人民银行最新金融稳定报告指出,AI已成为金融系统风险来源之一,杠杆股权带来巨大运营压力,前沿模型的网络风险并列信贷威胁。央行官员呼吁针对自主代理制定框架,以应对技术带来的挑战。这是央行首次将AI与信贷风险并列为系统级威胁,意味着金融监管即将为AI智能体应用构建适配性规则,相关合规工作可能优先在金融、能源、关键基础设施行业落地。

数据: 前沿模型网络风险被央行列入金融稳定议题

意义: 金融监管层对自主代理的合规需求正在形成

来源:展开 1 条收起 1 条

近三成企业高管不懂AI经济账

毕马威一项覆盖20个国家或地区2145名高级管理人员的调查显示,AI从固定价格包月按量计费模式的转变正让企业高管陷入成本焦虑。高达29%的受访者不知道AI成本上涨从何而来,近三分之一承认自己不懂AI的经济账。过去企业可通过固定合同让AI公司补贴算力,但随着算力价格攀升、补贴红利消退,token级实时计费使成本从可预测变为不可控。

数据: 29%受访者不知AI成本从何而来,三分之一不懂经济账

意义: AI按量计费倒逼企业建立全链路成本管理能力

来源:展开 1 条收起 1 条

其他值得看

Prime Intellect完成1.3亿美元A轮融资

AI代理平台独角兽,年化营收已达1亿美元。

来源:展开 2 条收起 2 条

Ollama融资6500万美元B轮

开源LLM本地化工具,月活开发者近900万。

来源:展开 1 条收起 1 条

Anthropic上线Claude Reflect回顾工具

使用回顾Beta功能上线,被吐槽形式大于内容。

来源:展开 3 条收起 3 条

智谱完成约314亿港元配售

港股AI大模型公司配售,资金用于基座模型与算力。

来源:展开 1 条收起 1 条

Sergey Brin罕见公开对谈Transformer与AGI

Google联合创始人承认Gemini编程能力曾被反超。

来源:展开 1 条收起 1 条

WAIC 2026世界人工智能大会下周启幕

7月17日至20日上海举办,超三百款新品首发。

来源:展开 4 条收起 4 条