内容
声明:完全使用AI生成,可能存在错误,需谨慎甄别。
摘要
2026-06-29 AI 领域呈现前沿模型分级部署与代理加速渗透的多线格局。值得关注:OpenAI 正式以受限形式发布 GPT-5.6 系列三款模型(Sol/Terra/Luna);Anthropic Fable 5 解禁在即;xAI Grok 4.5 已在 SpaceX、特斯拉内部私测,瞄准 Claude Opus;惠普 与 OpenAI 合作部署 Frontier 智能体平台;Momenta 启动港股招股募资约 58.9 亿港元。
热点事件
OpenAI GPT-5.6 系列以受限形式正式发布
OpenAI 于 6 月 29 日宣布以有限预览形式发布 GPT-5.6 系列模型,包括旗舰版 Sol、中端版 Terra 和低成本高吞吐版 Luna。此次发布出现重大转变:应美国政府要求,初始访问权限仅通过 Codex 和 API 向受信任合作伙伴开放,更广泛开放计划将在未来几周推进。Sam Altman 表示该方式并非 OpenAI 理想选择但愿意配合。技术层面,Sol Ultra 在 Terminal-Bench 2.1 上达 91.9%,Sol 被定位为迄今最强网络安全模型;三款定价分别为每百万 token $5/$30、$2.5/$15 和 $1/$6,Cerebras 将为 Sol 提供高达 750 tok/s 推理速度。此举引发社区对前沿模型访问正从广泛商业可用性转向政府协调、按风险等级分级部署模式的广泛担忧。
重点: 前沿模型访问走向政府协调分级部署
来源:展开 5 条收起 5 条
特朗普政府最快本周解除 Anthropic Fable 5 限制
据 Axios 援引知情人士,特朗普政府即将准许 Anthropic 重新开放其 Fable 5 大模型的使用权限,限制最早将于本周解除。上周末相关各方持续沟通协商,预计很快恢复访问。此前 Anthropic 已获美国政府批准,向部分美国本土「可信机构」开放 Claude Mythos 5 模型,相当于部分撤销两周前以国家安全风险为由暂停该模型使用权限的管制指令。另有消息称美国政府也计划很快允许 Anthropic 推出 Fable 模型,但具体落地时间尚未明确。
重点: 前沿模型政策从全面管制转向有条件恢复
来源:展开 2 条收起 2 条
xAI Grok 4.5 启动 SpaceX 与特斯拉内部私测
埃隆·马斯克宣布,xAI 旗下最新大语言模型 Grok 4.5 已在 SpaceX 与 特斯拉 内部启动私测,标志着该模型从实验室走向复杂实际应用场景。技术底座为 1.5 万亿参数的 V9 模型,补充训练引入 Cursor 数据以提升代码与复杂任务处理能力。早期评测显示其综合能力已接近甚至有望超越 Anthropic Claude Opus。团队正通过强化学习持续调优,并完善「Grok Build」测试基准。马斯克还透露,SpaceX 将保持每月发布一款全新模型的迭代频率,所有模型均从头训练,预示大模型赛道竞争将进入更频繁的「肉搏战」时代。
重点: Grok 4.5 进入真实产业场景内测
来源:展开 3 条收起 3 条
惠普与 OpenAI 联手部署企业级智能体平台 Frontier
惠普与 OpenAI 近日宣布达成战略合作,将在全球业务中全面部署 OpenAI 的企业级智能体平台 Frontier,以推动企业数字化转型与增长。该平台支持跨业务共享上下文、员工入职培训、反馈式学习及安全权限边界,并可与现有系统、应用和已部署智能体平滑集成,无需强制重新部署或改变数据格式。通过 ChatGPT、Atlas 工作流或业务软件等多入口,AI 智能体可协同工作,优化内部运营并提升客户服务体验。惠普与 Intuit、Oracle、State Farm 等企业成为 Frontier 平台的首批采用者,业务体系有望加速向智能化、自动化转型。
重点: OpenAI Frontier 平台首批企业客户落地
来源:展开 3 条收起 3 条
- 惠普与 OpenAI 达成战略合作,加速布局 AI 智能体平台 Frontier(AI新闻资讯)
- HP Inc. 启动与 OpenAI 的 Frontier 战略合作(OpenAI News)
- AI 开启打工新模式:惠普与 OpenAI 升级战略合作(AI新闻资讯)
Momenta 启动港股招股募资约 58.9 亿港元
物理 AI 领军企业 Momenta 正式启动港股招股,股票代码为「6880」,中金公司与德意志银行担任联席保荐人。公司计划全球发售约 1993.8 万股,定价 295.6 港元,预计募资总额达 58.9 亿港元。本次 IPO 吸引 14 家机构组成超豪华基石投资者阵容,认购总额约 30 亿港元,其中新加坡政府投资公司与富德国际各获配 1 亿美元领投,梅赛德斯-奔驰与比亚迪分别追加 2500 万和 1500 万美元。资本热捧得益于技术突破与强劲财务表现:今年 4 月 Momenta R7 世界模型实现量产,全面支撑乘用车、Robotaxi 及 Robovan 规模化落地;2023 至 2025 年营收从 7.43 亿元跃升至 24.13 亿元,年均复合增长率超 80%。本次募资净额的 60% 将用于研发加强核心技术及推进新一代智能驾驶解决方案。
重点: 物理 AI 赛道首次大规模 IPO 落地
来源:展开 2 条收起 2 条
- Momenta开启港股招股,拟募资58.9亿港元深化物理AI布局(AI新闻资讯)
- Momenta 启动港股招股,奔驰、比亚迪等现身基石名单(极客公园)
变更与实践
Anthropic 获准 Mythos 5 恢复部分美国关键基础设施访问
Anthropic 表示,美国政府已通知其 Mythos 5 可以重新部署给一批美国关键基础设施组织,而更广泛的访问恢复以及通用的 Fable 5 访问权限仍在谈判中。此举进一步强化了按行业、有条件访问的新兴模式,而非通用的 API 开放。多个帖子将此与开源模型和非美国生态系统的相对激励增强联系起来,尤其是在闭源实验室面临监管摩擦、而中国开源模型持续进步的情况下,引发对「AI 种姓制度」风险的担忧。
来源:展开 1 条收起 1 条
- Anthropic选择性恢复Mythos 5模型访问权限(AI 开发者日报)
DeepSeek 完成 74 亿美元融资,梁文锋自掏约 30 亿美元
The Information 曝光 DeepSeek 开启融资的直接导火索:梁文锋看到 Claude Mythos 通过海量算力和数据训练出超强能力后,意识到不储备弹药根本无法继续竞争。DeepSeek 完成 74 亿美元融资,梁文锋自己出资 200 亿人民币(约 30 亿美元)占总额的五分之二。融资后团队将从约 300 人扩招「至少翻倍」,核心 Harness 团队已每天面试。DeepSeek 正在适配华为芯片,梁文锋相信华为几年内能追上英伟达,但适配代价是长达 15 个月未发布新模型,错过了 Claude Code 掀起的编程工具热潮。梁文锋坚持开源、低价、专注 AGI 的战略,表示「AI 不应该被少数人控制」,DeepSeek 是唯一完全开源的主要 AI 实验室。
来源:展开 1 条收起 1 条
OceanBase 发布湖库一体 AI 数据库,瞄准 Agent 数据底座
6 月 29 日,OceanBase 发布面向 AI 时代的湖库一体 AI 数据库,提出以湖库一体为核心架构,将数据湖的开放存储能力、数据库的事务处理与分析能力、多模态数据处理能力统一到一套强一致的数据底座上,帮助 Agent 一次获取完整业务上下文。围绕该能力,OceanBase 同步推出覆盖数据引擎、数据治理与业务入口的产品体系,包括 Lakebase、DataStudio、DataPilot 等。相较传统多系统方案,该方案可降低整体 TCO 约 30%-50%,已在蚂蚁阿福、灵光等 AI 场景完成业务验证。业内认为,随着 Agent 成为数据库新的使用者,AI 数据库正成为 AI 时代新的基础设施形态。
来源:展开 2 条收起 2 条
百度昆仑芯计划港股 IPO,目标估值约 500 亿美元
百度旗下 AI 芯片子公司昆仑芯计划在香港上市,目标估值约为 500 亿美元。据报道,部分投资者被要求认购价值相当于其计划申购金额 3-7 倍的芯片产品。昆仑芯成立于 2012 年,原为百度内部 AI 芯片研发部门,百度目前仍为控股股东。此前传闻字节跳动考虑采用昆仑芯 AI 芯片,另有消息称腾讯已成为其客户。若成功上市,这将成为昆仑芯资本化的重要里程碑,并为全球 AI 算力市场带来新的催化剂。
来源:展开 3 条收起 3 条
- 百度旗下昆仑芯计划在香港 IPO,目标估值约 500 亿美元(极客公园)
- 百度旗下昆仑芯计划赴港 IPO,目标估值 500 亿美元(Readhub - 每日早报)
- 消息称百度昆仑芯将赴港IPO 目标估值达500亿美元(AI新闻资讯)
OpenAI 与韩国 AI 安全研究所达成深度合作
OpenAI 与韩国人工智能安全研究所正式签署合作备忘录,双方将围绕高级人工智能系统在网络安全等高风险领域的评估展开合作,重点包括安全评估方法、基准测试及技术信息交流,并计划定制韩语及本地化评估标准。此次合作是 OpenAI 继与美国、英国和日本之后,达成的第四个国家级 AI 安全合作。
来源:展开 1 条收起 1 条
- 全球第四家!OpenAI 与韩国人工智能安全研究所达成深度合作(AI新闻资讯)
安全与风险
PuffPal 公共互联网泄露近百万份护照与身份证
近百万份护照和照片身份证件被留在公共互联网上,未设置任何密码或访问控制。安全研究员 Sammy Azdoufal 发现,西班牙等地约 985,000 份用户照片身份证件通过简单公开 URL 暴露,涉及使用 Cannabis Club Systems(CCS,原 Nefos) 软件及 PuffPal 应用的多个大麻俱乐部。受影响用户包含来自西班牙、意大利、法国、南非、英国及美国约 30,000 名在内的全球访客,部分用户姓名、电话、住址、大麻偏好等也一并泄露。Nefos 将软件开发外包给 9Series,导致 PuffPal 内嵌 Stripe 密钥、API 缺乏有效认证,管理员门户与部分用户数据长期可被外部访问。事件曝光后 Nefos 曾短暂锁住图片,但因俱乐部投诉又再次解锁,直到 6 月 10 日记者测试时护照图像与个人资料才趋于安全。
影响: 近百万欧洲及全球大麻俱乐部访客
建议: 立即停用 PuffPal 应用、监测护照滥用、向数据保护机构报案
来源:展开 1 条收起 1 条
- PuffPal:用于访问大麻俱乐部的应用泄露100万用户护照(Andrej Karpathy Curated RSS)
Cloudflare 披露 hyper HTTP 库竞态致响应截断
Cloudflare 发布生产故障复盘,披露其使用的 Rust HTTP 库 hyper 存在竞态条件 bug。当 pollflush 遇到 Poll::Pending 时,内部调度错误丢弃了该状态,导致 HTTP/1 连接被过早关闭,客户端收到截断的响应和提前的 EOF。故障通过客户投诉才被发现,引发对基础设施级服务可观测性和监控敏感度的质疑。评论区还围绕 Rust async 中 let = 写法和 ? 操作的语义进行了讨论,指出这种写法在 async 状态机中容易引发误判。
影响: Cloudflare 使用 hyper 的服务及其客户端
建议: 升级 hyper 至修复版本、加强异步状态机代码审查
来源:展开 1 条收起 1 条
- 😬 Hyper HTTP 库竞态致响应截断,Cloudflare 才发现(News Hacker | 极客洞察)
词元盗用正在成为 AI 商业化新风险
AI 智能体商业化进程中,Token(词元)盗用正成为新型欺诈风险。攻击者目标从传统信用卡窃取转向盗用 AI 企业的推理资源、模型能力和 Token 额度,主要手段包括滥用免费试用和账户批量注册。Stripe 数据显示,其平台上 AI 服务滥用免费试用情况 6 个月内激增一倍以上,每 6 次注册中有 1 次为恶意行为,提供自助注册和开放 API 的 AI 初创企业面临滥用比例比 SaaS 企业高出10 倍。Stripe Radar 完成史上最大升级,通过前置账户风险识别、按量计费欠费预测及机器交易行为评分等手段,一个月内为 8 家 AI 公司成功拦截330 万次高风险注册。
影响: 提供自助注册和开放 API 的 AI 企业
建议: 前置账户风险识别、按量计费欠费预测、机器行为评分
来源:展开 1 条收起 1 条
开源与工具
小红书开源 RedKnot 长文本推理引擎,KV Cache 按头解耦
小红书发布 RedKnot 推理引擎,针对长文本 LLM 推理中 KV Cache 显存占用大、TTFT 高、并发受限等问题,提出将 KV Cache 沿注意力头维度解耦的全新架构。核心机制包括:头分类稀疏离线区分全局头与局部头,局部头占比 83%–97%;稀疏 FFN 仅对 top-k token 执行稠密计算;SegPagedAttention 实现按层和头分段的分页 KV 存储,配合融合变长注意力内核使各头始终走 FlashAttention 快速路径。论文实验显示最高带来 1.6–3.54× TTFT 加速、4.7–7.8× 单卡并发提升、预填充算力削减 67%–79.5%,128K 上下文下内核耗时从 5.42s 降至 0.23s(23.3×),且精度保持稠密基线的 95% 以上。RedKnot 基于 SGLang 实现,已在 GitHub 开源。
适用场景: 长文本大模型推理服务部署
来源:展开 1 条收起 1 条
- 让 KV Cache「按头分家」:小红书 RedKnot 如何重做长文本推理新引擎(小红书技术REDtech)
agency-agents:覆盖 16 部门的多代理协作框架开源
msitarzewski/agency-agents 是一个 GitHub Trending 开源项目,将 AI 代理组织成不同「部门」的集合,每个代理拥有专业领域、独特个性和可交付成果。项目支持 Claude Code、Cursor、Codex、Gemini 等主流 AI 编码工具,提供桌面客户端(macOS/Linux/Windows)实现一键安装和自动更新。目前拥有 118k Stars、19.4k Forks,涵盖工程、设计、营销、财务等 16 个部门,总数达数百个专业化 AI 代理。MIT 许可证,支持社区贡献,为开发者提供开箱即用的 AI 团队协作解决方案。
适用场景: 多角色 AI 团队协作流程实验
来源:展开 1 条收起 1 条
- msitarzewski/agency-agents:开源AI代理部门化协作框架(Trending repositories on GitHub today · GitHub)
VulnClaw:基于 AI Agent 的智能渗透测试 CLI 开源
VulnClaw 是基于 AI Agent + MCP 工具链 + 渗透 Skill 编排的智能渗透测试 CLI 工具,支持自然语言输入自动完成「信息收集 → 漏洞发现 → 漏洞利用 → 报告生成」全流程。项目采用目标驱动求解引擎,将渗透建模为状态空间搜索,用 Fact(已确认事实)和 Intent(探索方向)驱动循环,结构上杜绝重复打转;内置证据级反幻觉闸门,声称的 flag 必须在真实工具输出中逐字符出现才被采信。支持 13 个 LLM Provider、4 个 MCP 服务、21 个渗透 Skill 及 29 种编解码工具。当前获 961 Stars、155 Forks,采用 MIT 许可证,适用于已授权渗透测试、CTF 竞赛、安全教学等场景。
适用场景: 已授权渗透测试与 CTF 竞赛
来源:展开 1 条收起 1 条
- VulnClaw:基于AI Agent与MCP工具链的智能渗透测试CLI工具(Trending repositories on GitHub today · GitHub)
audio.cpp 整合 12 个音频模型于单一 C++ 运行时
audio.cpp 是一个原生 C++/ggml 音频推理运行时,将 TTS/ASR/VAD/语音转换/编解码/编辑模型整合到单一部署栈中,目前列出 25 个模型家族、12 个已发布可供正常使用,包括 Qwen3-TTS/ASR、PocketTTS、Vevo2、Silero VAD、Seed-VC 等。在 Ubuntu/CUDA 环境下实测:Vevo2 单次生成加速比达 5.03×,PocketTTS 长文本实时率达 48.40×。其主要价值在于用单一运行时替代众多固定的 Torch/Gradio 环境,类似于 llama.cpp 之于 LLM 的整合方式。当前限制包括主要支持离线/非流式工作流,后端覆盖不均衡。
适用场景: 本地音频模型统一部署
来源:展开 1 条收起 1 条
- audio.cpp整合12个音频模型于单一C++运行时(AI 开发者日报)
数据与洞察
Anthropic 调查:半数用户认为 AI 已能承担过半工作
Anthropic 最新发布的近万名用户调查显示,接近一半的 Claude 用户认为 AI 已能独立承担日常工作中一半甚至更多的任务。在约 9700 名受访者中,33% 表示 AI 能完成 30% 至 60% 的工作,14% 认为占比高达 60% 至 90%,另有约 4% 用户称 Claude 几乎可完全接管全部工作。应用层面,超过八成 受访者经常使用 Claude 进行数据库查询、博客或文章创作及营销文案撰写,成为 AI 落地主力场景。
数据: 9700 名受访者中 47% 认为 AI 已能承担过半工作;4% 称 Claude 几乎完全接管
意义: 反映企业级 AI 落地已进入实质工作接管阶段
来源:展开 1 条收起 1 条
- 半数用户解放双手:Anthropic调查显示AI已能承担过半工作(AI新闻资讯)
69 年内存价格史:每 GB 价格下降 3210 亿倍
斯坦福大学 DAM 研究项目发布《DRAM、HBM 和 NAND 闪存的历史价格和当前价格》报告。数据显示内存价格从1957 年的 4110 亿美元/GB,暴跌至2023 年最低点 1.28 美元/GB,降幅高达3210 亿倍。然而受AI 需求猛烈增长影响,这一持续数十年的降价趋势在近两年被逆转:2024 年触底回升,2025 年 DDR5、DDR4 涨势加快,2026 年 DDR3、DRAM、NAND 全面上涨,涨价范围持续扩大。
数据: 1957 年 4110 亿美元/GB → 2023 年 1.28 美元/GB,降幅 3210 亿倍;2024 年起触底回升
意义: AI 算力需求已打破持续数十年的内存降价趋势
来源:展开 1 条收起 1 条
GitLab 研究:AI 编码提速但整体软件交付未同步加速
GitLab 发布 2026 年 AI 问责报告,揭示AI 悖论:虽然78% 的开发者表示 AI 工具加快了编码速度,73% 认为代码质量有所提升,但85% 的受访者认为瓶颈已从写代码转移到代码审查与验证环节。79% 的受访者指出整体软件交付并未同步加速。报告显示,87% 的受访者相信团队可在 24 小时内判断 AI 代码是否导致生产事故,但实际过去一年经历过事故的组织中,仅34% 能够真正做出判断。
数据: 78% 认为 AI 加快编码、79% 认为整体交付未同步加速;85% 认为瓶颈已转向审查验证
意义: AI 编程价值集中在代码生成,整体研发瓶颈转向治理
来源:展开 1 条收起 1 条
新浪开源 VibeThinker-3B,3B 参数逼近百倍大模型性能
新浪开源 VibeThinker-3B 模型,仅 30 亿参数却在数学、编程等高难度基准测试中展现出足以媲美百倍规模大模型的性能,在 LeetCode 竞赛题目中完成 128 道题中的 123 道,超越GPT-5.2等行业标杆。该模型以阿里 Qwen2.5-Coder-3B 为基底,通过监督微调、强化学习、自蒸馏及指令微调等多阶段后训练实现能力浓缩。研发团队提出「参数压缩-覆盖假说」,指出逻辑推理、编程运算等结构清晰任务可被极高密度压缩,意味着未来推理任务不必依赖成本昂贵的超大模型。目前已在 Hugging Face 和 GitHub 正式开源。
数据: 30 亿参数;LeetCode 竞赛 128 题中完成 123 题;超越 GPT-5.2
意义: 小模型后训练路径可在垂直推理任务上逼近超大模型
来源:展开 1 条收起 1 条
其他值得看
福特因 AI 质控不及预期重聘 350 名工程师
福特因 AI 质控不及预期重聘 350 名工程师,节省数亿美元。
来源:展开 5 条收起 5 条
- 福特因AI质控不及预期重聘350名资深工程师,成功挽回数亿美元成本(AI新闻资讯)
- AI未达预期后,福特重新聘用“灰胡子”资深工程师(TechCrunch)
- 🙄 福特回聘资深工程师,评论区炮轰 AI 高管幻觉(News Hacker | 极客洞察)
- 😏 Ford AI 替代翻车,350 名工程师被请回(News Hacker | 极客洞察)
- 因 AI 未能达到预期福特公司重聘人类工程师(奇客Solidot–传递最新科技情报)
Proception 与特斯拉和解并完成 1100 万美元融资
机器人手公司 Proception 与特斯拉和解商业秘密诉讼,融资 1100 万美元。
来源:展开 1 条收起 1 条
- 机器人手公司Proception与特斯拉和解商业秘密诉讼,并宣布完成1100万美元融资(TechCrunch)
Pocket 融资 1100 万美元押注 AI 笔记设备
AI 会议记录设备 Pocket 融资 1100 万美元,已售出超 13 万台设备。
来源:展开 1 条收起 1 条
- Pocket融资1100万美元,押注AI笔记设备需求增长(TechCrunch)
甲骨文云保留免费老账号 24GB 顶配实例
甲骨文云确认已开机的 24GB 顶配免费实例可保留,不强制降级。
来源:展开 1 条收起 1 条
曹操出行聘任图灵奖得主希发基思
曹操出行宣布图灵奖得主 Joseph Sifakis 出任 AI 首席顾问。
来源:展开 1 条收起 1 条
- 图灵奖得主加盟,曹操出行加速挺进“AI原生”新赛道(AI新闻资讯)
DeepSeek V4 调价预告高峰时段价格翻倍
DeepSeek 预告 V4 正式版 7 月中旬上线,高峰时段价格翻倍。
来源:展开 3 条收起 3 条
- 深度求索宣布DS V4系列模型将在7月增加峰谷机制 白天价格翻倍 夜晚价格不变(蓝点网)
- DeepSeek V4 正式版 7 月上线,引入峰谷定价机制(Readhub - 每日早报)
- DeepSeek V4 调价预告:高峰时段价格翻倍,正式版7月中旬发布(小众软件)
高德内测 AI 编程产品袋马
高德内测 Vibe Coding 产品「袋马」,自然语言分钟级生成应用。
来源:展开 1 条收起 1 条
- 高德内测“袋马”入局AI编程,一句话分钟级生成可用应用(AI新闻资讯)
普林斯顿 CEO-Bench 测试 AI 经营公司
普林斯顿 CEO-Bench 让 AI 经营虚拟公司 500 天,仅 4 席保本。
来源:展开 1 条收起 1 条
- AI当老板,快给10家公司干破产了…(量子位)
NVIDIA 开源扩散式语言模型 Nemotron-TwoTower
NVIDIA 发布 Nemotron-TwoTower-30B,开源扩散式语言模型参考实现。