内容
声明:完全使用AI生成,可能存在错误,需谨慎甄别。
摘要
2026-07-08 AI领域呈现多线并进格局,值得关注的信息:OpenAI GPT-5.6三档模型获美商务部放行;微软投入25亿美元组建6000人AI部署团队;自动驾驶公司Momenta港股上市获413.6倍超额认购;Claude Cowork登陆网页与移动端;蚂蚁灵波开源LingBot-VLA 2.0六万小时真机数据基模;同期Claude Code被曝内置安全后门,阿里巴巴已宣布禁用。
热点事件
OpenAI GPT-5.6三档模型获美政府放行
OpenAI在美国商务部正式放行后,本周将推出GPT-5.6三档模型——旗舰Sol、均衡Terra与低成本Luna,并新增Sol Ultra模式。Sol Ultra在Terminal-Bench 2.1编码基准上达91.9%,超越Anthropic Claude Mythos 5;三档API定价依次为5/30、2.5/15、1/6美元每百万token,计划7月通过Cerebras实现最高750 tok/s推理。值得注意的是,应美国政府要求,初期仅向约20家经审批的可信合作伙伴开放Codex和API预览权限;Anthropic仍受出口管制限制,竞争格局可能再度分化。
重点: 美国政府放行,分阶段发布三档模型
来源:展开 8 条收起 8 条
- OpenAI发布GPT-5.6系列并采取受限发布模式(AI 开发者日报)
- OpenAI发布GPT-5.6三件套:Sol、Terra、Luna分层覆盖旗舰到经济型(极客公园)
- OpenAI 发布 GPT-5.6 系列:Sol 编程跑分超 Mythos 5,分层安全设计应对高风险任务(极客公园)
- OpenAI 正式发布 GPT-5.6 系列模型(爱范儿)
- OpenAI 发布 GPT-5.6 系列预览版,初期访问受美政府要求限制(AINews)
- OpenAI 或将于下周发布 GPT-5.6,新增 Sol/Terra/Luna 模型层级(AI Valley)
- 美国政府松绑GPT-5.6:商务部正式放行,OpenAI本周全面推出(AI新闻资讯)
- 美国放行GPT-5.6,OpenAI多款重磅模型本周上线(AI新闻资讯)
微软25亿美元组建6000人AI部署团队
微软宣布投入25亿美元成立新业务部门Microsoft Frontier Company,整合约6000名工程师、技术顾问和销售团队,专门派驻客户企业内部提供AI部署服务。这种被称为「前沿部署工程」的模式旨在深入客户运营一线,现场设计、构建和部署AI系统,新部门由Rodrigo Kede Lima领导。此举与亚马逊、Meta等近期削减AI开支的行业趋势形成对比,反映出微软在企业级AI落地服务上继续加大押注,试图把工程能力嵌入客户业务深处。
重点: 25亿美元组建6000人AI部署团队
来源:展开 2 条收起 2 条
- 微软注资25亿美元组建新部门,向企业派遣6000名工程师(AI洞察日报 RSS Feed)
- 微软投入 25 亿美元组建 6000 人 AI 部署团队(极客公园)
Momenta港交所主板上市认购413.6倍
自动驾驶公司Momenta于7月8日正式登陆港交所主板(代码6880.HK),发行价295.6港元/股,若行使绿鞋全球发售约2293万股,募资约68亿港元。市场认购火爆,公开发售获413.6倍超额认购,国际发售吸引超1000亿港元机构订单,覆盖15个国家和地区。Momenta搭载量已突破100万辆,累计交付超100款量产车型、定点超210款,城市NOA第三方供应量全球第一;认购阵容涵盖GIC、富达、贝莱德、淡马锡等国际长线机构。
重点: 搭载量破百万,认购413.6倍
来源:展开 1 条收起 1 条
- 搭载量突破百万辆,Momenta 上市收获千亿认购订单(晚点 - 最新报道)
Anthropic Claude Cowork登陆网页与移动端
Anthropic于7月7日将Claude Cowork扩展至网页端和移动端,首批面向Max订阅用户开放Beta测试。新版本支持跨设备接力与云端后台运行:桌面端发起的任务可在笔记本电脑关闭后持续执行,手机可查看进度或接收结果,涉及关键决策时推送至用户确认。根据Anthropic基于60万家机构、120万次会话的早期数据,超九成使用场景并非软件开发,业务流程运营占比33.4%、内容创作占16.4%、编程仅占8.7%,表明Cowork正从编程助手转型为通用办公搭档。
重点: Cowork登陆网页与移动端,90%非编程
来源:展开 5 条收起 5 条
- Anthropic Claude Cowork 上线移动端和网页端(TLTD)
- AI办公新动作:Claude Cowork 移动端与网页版正式上线(AI新闻资讯)
- Claude Cowork 即将登陆移动端和网页端(Claude Blog)
- Anthropic 将 Claude Cowork 扩展至网页与移动端(少数派)
- Claude Cowork 即将登陆移动端和网页端(Claude Blog)
蚂蚁灵波开源LingBot-VLA 2.0具身基模
蚂蚁灵波正式开源通用具身基座模型LingBot-VLA 2.0,预训练数据从1.0版扩至6万小时,含5万小时真机轨迹与1万小时第一视角人类操作视频,覆盖20余种机器人构型、横跨17家厂商。模型采用55维统一动作表示与token-level MoE架构,动作空间从双臂扩展至头部、腰部、底盘与灵巧手等全身自由度。在上海交大GM-100双臂操作评测中,任务进度和成功率均超越π0.5和GR00T N1.7,RTX 4090推理延迟控制在130ms以内。权重与代码已在GitHub、Hugging Face和魔搭社区开源,并联合乐聚等本体伙伴启动商业落地测试。
重点: 6万小时数据,覆盖20+机器人构型
来源:展开 4 条收起 4 条
变更与实践
微软加速部署自研MAI模型替代OpenAI与Anthropic
微软正加速在核心产品中部署自研MAI模型,逐步替代对OpenAI和Anthropic的依赖。MAI模型已在Excel、Outlook和GitHub Copilot中投入使用,每周处理数以万计的AI任务。微软AI负责人Mustafa Suleyman明确表示正减少并最终消除对Anthropic的高额支出,未来数月自研转录模型还将扩展至Teams视频会议。此前Build大会上微软已发布7款新MAI模型,核心动因是降低AI运营成本、掌握核心能力自主权。
来源:展开 4 条收起 4 条
- 微软加入AI降本趋势,更多依赖自研模型(TechCrunch)
- 微软开始在部分软件中改用自研 AI 模型 减少对 OpenAI 和 Anthropic 依赖(Readhub - 每日早报)
- 微软AI战略大调整:减负降本,Excel与Outlook率先“去依赖”(AI新闻资讯)
- 微软开始"甩掉"OpenAI和Anthropic:自研MAI模型悄然接手Excel和Outlook(AI新闻资讯)
Google扩展Gemini API Managed Agents能力
Google于7月7日为Gemini API中的Managed Agents推出多项新能力。智能体可在隔离云沙盒中执行推理、代码运行、包安装、文件管理和网页检索。新增后台执行支持异步处理长任务、远程MCP服务器集成连接私有数据库与内部API、自定义函数调用与沙盒工具混合使用,以及网络凭证刷新机制支持密钥轮换同时保留文件系统状态,便于开发者构建可靠、可投入生产的智能体。
来源:展开 1 条收起 1 条
- 扩展 Gemini API 中的托管智能体:后台任务、远程 MCP 等(The Keyword)
Anthropic Claude Code与Cowork开放政府测试
Anthropic于7月7日宣布将Claude Code和Claude Cowork面向政府部门开放公开测试,集成至Claude for Government Desktop,通过FedRAMP High授权环境部署。Claude Code可帮助公共部门团队构建和现代化公共服务软件系统,Claude Cowork可直接处理桌面文件,支持备忘录撰写、RFP评审等任务。治理方面新增管理员配置默认值、防篡改审计日志及支持机构ATO流程的文档。
来源:展开 1 条收起 1 条
- 将 Claude Code 和 Claude Cowork 引入政府部门(Claude Blog)
Figma收购vibe-coding平台Bud团队
Figma收购vibe-coding与AI智能体平台Bud(前身Orchids)的团队。Bud最初由Y Combinator孵化,后转型为可自动化任务、调用多种服务的智能体平台。交易完成后,Bud与Orchids将于7月18日关停,用户需在此前完成迁移。BBC曾报道Orchids生成的应用存在网络攻击隐患。此举表明Figma正从纯设计工具向应用构建与原型开发方向扩展,将编码层与画布拉得更近。
来源:展开 1 条收起 1 条
- Figma 收购 vibe-coding 应用背后的团队(TechCrunch)
安全与风险
Claude Code内置安全后门被披露
工信部NVDB发布安全提示,AI编程工具Claude Code 2.1.91至2.1.196版本被曝内置安全后门,未经授权回传用户地理位置、身份标识等敏感数据。该机制自4月2日起植入,通过系统时区识别中国用户且未在更新日志披露。Anthropic称此为防止账户转售的「实验性」措施,已于7月2日移除。受此影响,阿里巴巴宣布自7月10日起全面禁止员工办公环境使用Claude Code,并将其列入高风险软件名单。
影响: Claude Code中国用户及企业内开发环境
建议: 升级至2.1.196以上版本并审查历史日志
来源:展开 1 条收起 1 条
港科大提出提示词压缩黑盒攻击框架COMA
港科大提出黑盒攻击框架COMA,揭示大模型Agent中提示词压缩模块会重写系统安全边界、构成新型攻击面。COMA通过对非可信输入施加扰动,诱导压缩器删除关键安全规则或任务证据,在六种压缩器、三类任务上平均攻击成功率达0.71,并在VSCode Cline、LangChain Agent真实场景中验证有效。研究同步提出「隔离压缩」防御方案,防御成功率达96%,论文已被ASE 2026接收。
影响: 使用提示词压缩的Agent系统
建议: 采用隔离压缩方案分离可信与不可信输入
来源:展开 1 条收起 1 条
Android远程root漏洞链利用Firefox与内核缺陷
安全公司Nebula发布Android远程root演示视频,揭露一条利用Firefox v151.0.2及之前版本浏览器漏洞配合Linux Kernel中潜伏15年的内核漏洞的攻击链。用户点击恶意URL后,攻击在不到1分钟内触发任意代码执行、关闭SELinux并完成提权,最终自动安装su二进制文件、获得持久化root权限。演示已在Google Pixel系列设备、Android 17上验证成功,公司已同步通报厂商修复。
影响: Firefox v151.0.2及以下版本Android设备用户
建议: 立即升级Firefox并关注内核补丁推送
来源:展开 1 条收起 1 条
开源与工具
蚂蚁集团开源LingBot-Vision视觉Transformer家族
蚂蚁集团旗下具身智能公司Robbyant开源LingBot-Vision模型家族,这是一系列采用自监督学习的视觉Transformer模型,核心创新在于将「边界建模」作为预训练原生信号。旗舰模型ViT-g/16仅11亿参数,却在NYU-Depth v2等深度估计任务中超越拥有70亿参数的DINOv3,训练语料库规模仅为其约三分之一。系列同步提供3亿参数起的蒸馏版本以适配低算力场景,模型已在Hugging Face以Apache-2.0协议开源。
适用场景: 机器人物理感知与3D深度估计低算力场景
来源:展开 1 条收起 1 条
腾讯云开源TencentDB Agent Memory分层记忆系统
腾讯云开源AI Agent记忆系统TencentDB Agent Memory,采用符号化短期记忆+分层长期记忆双架构。短期记忆通过Mermaid符号图将冗长工具日志卸载为压缩画布,长期记忆将对话蒸馏为L0对话→L1原子事实→L2场景→L3人物画像的语义金字塔。集成OpenClaw后,WideSearch任务成功率相对提升51.52%,token消耗降低61.38%;PersonaMem准确率从48%提升至76%,系统同时支持本地SQLite后端零配置启动。
适用场景: AI Agent长期记忆与多轮上下文管理
来源:展开 1 条收起 1 条
- 腾讯云开源TencentDB Agent Memory:面向AI Agent的分层记忆系统(Trending repositories on GitHub today · GitHub)
阿里开源进程内向量数据库ZVec
阿里巴巴推出轻量级向量数据库ZVec,采用进程内架构,具有占用内存低、处理速度快的特点。该项目在社区内获13.4k星关注,使本地部署向量检索变得更加省心高效,特别适合资源受限场景下的向量召回需求,为AI应用开发提供了便利的基础设施。
适用场景: 本地轻量级向量检索与RAG应用
来源:展开 1 条收起 1 条
- 阿里开源轻量级向量数据库ZVec,采用进程内架构占用内存低(AI洞察日报 RSS Feed)
英伟达发布统一音频智能模型Audex
英伟达研究团队发布统一音频-文本大语言模型Nemotron-Labs-Audex-30B-A3B(简称Audex),采用纯文本MoE架构与单一Transformer解码器,实现文本与量化音频token统一处理。训练数据涵盖1574亿音频token和3205亿文本token,在音频理解、语音识别、翻译及音频生成等任务上达到行业领先水平,同时几乎完整保留了原版LLM在推理、对齐方面的核心能力。
适用场景: 多模态音频理解、翻译与生成场景
来源:展开 1 条收起 1 条
数据与洞察
Anthropic披露Claude Cowork使用场景分布
Anthropic基于2026年5月期间采集的120万条匿名Claude Cowork会话(来自超过60万家组织)进行分析后披露:最大使用类别为「业务流程与运营」,占比达33.4%,排名第二的是「内容创作与文案撰写」占16.4%,两者合计约占总使用量的一半。其余依次为软件开发8.7%、DevOps与基础设施7%、研究与情报6.4%。这表明Claude Cowork主要被用于本职工作之外的辅助性任务,已超出编程范畴。
数据: 业务流程运营占33.4%,编程仅8.7%
意义: AI正从编程助手转型为通用办公搭档
来源:展开 1 条收起 1 条
- 人们如何使用 Claude Cowork:Anthropic 基于 120 万条会话数据的分析(Claude Blog)
三星电子算力芯片营业利润增长十八倍
三星电子财报显示,受算力芯片需求暴增推动,其营业利润增长了十八倍。全球高性能硬件订单正在亚洲积聚,芯片厂商正全力扩建数据中心产能,反映出AI算力需求对半导体行业的巨大拉动效应,存储与逻辑芯片公司均受益于训练与推理端的双重需求。
数据: 营业利润增长18倍
意义: 算力芯片需求拉动半导体行业高速增长
来源:展开 1 条收起 1 条
- 算力芯片需求大爆发,三星电子营业利润增长十八倍(AI洞察日报 RSS Feed)
研究称AI重投资企业员工数两年增长10%
一项针对超过21000家美国公司的新研究发现,在AI上投资最多的企业在过去两年中员工数量增加了10%,初级职位招聘增长了12%。研究结果表明,AI正在帮助企业更快增长并创造新角色,而不仅仅是取代现有工作,与AI替代论形成对比。
数据: 重投资企业员工增10%,初级岗增12%
意义: AI加速企业招聘而非全面替代人力
来源:展开 1 条收起 1 条
- 新研究:AI 采用加速招聘,重投资企业员工增长 10%(AI Valley)
其他值得看
ZML免费推理服务器跨多芯片
法国ZML发布跨多芯片推理产品。
来源:展开 1 条收起 1 条
- 法国热门初创公司ZML发布免费产品,加速跨多种AI芯片的推理(TechCrunch)
Meta超级智能实验室首发Muse Image
Meta多平台免费上线Muse图像生成。
来源:展开 3 条收起 3 条
可灵AI完成30亿美元融资
AI视频独角兽可灵AI创纪录融资。
来源:展开 1 条收起 1 条
DeepSeek秘密自研推理AI芯片
DeepSeek约一年前已启动芯片研发。
来源:展开 2 条收起 2 条
- DeepSeek秘密造芯!专攻推理,一年前已启动,招聘全程不公开(量子位)
- 消息称 DeepSeek 正在自研推理芯片(Readhub - 每日早报)
蓝色起源以1300亿美元估值融资100亿
贝索斯旗下蓝色起源首启外部融资。
来源:展开 1 条收起 1 条
- 蓝色起源据报道以1300亿美元估值融资100亿美元(TechCrunch)
高德发布Phys AI Data空间数据基座
高德推出业内首个物理AI数据系统。
来源:展开 1 条收起 1 条
小米调整小爱同学组织架构
罗福莉MiMo团队负责基础模型能力。
来源:展开 1 条收起 1 条
- 消息称小米调整「小爱同学」组织架构:罗福莉 MiMo 团队负责基础模型能力,原负责人王刚调任机器人业务(Readhub - 每日早报)
Anthropic纽约租赁16层办公楼扩军至千人
Anthropic纽约员工规模翻倍至1000人。
来源:展开 1 条收起 1 条
智源悟界·Orca发布世界模型技术报告
Orca以Next-State Prediction为核心路线。
来源:展开 1 条收起 1 条
VAST完成A3战略轮超10亿元融资
VAST从AI 3D延伸至世界模型方向。