07-01日报 | Sonnet 5发布、美解除Anthropic管制、ChatGPT推理成本减半、Kimi估值破315亿

来源:80 个引用生成:2026/07/03 00:27

内容

声明:完全使用AI生成,可能存在错误,需谨慎甄别。

摘要

2026-07-01 AI 领域呈现多线并进格局,值得关注的信息:Anthropic发布Claude Sonnet 5,SWE-bench Verified达92.4%美国商务部正式解除Fable 5与Mythos 5出口管制。OpenAI将ChatGPT访客推理成本削减过半,所需GPU降至数百块。月之暗面Kimi投前估值涨至315亿美元ARR突破3亿美元Claude Code暗藏代码检测中国用户并封锁IP,Anthropic承认将于次日版本完全回滚相关代码。

热点事件

Anthropic发布Claude Sonnet 5,定位便宜版Opus

Anthropic于7月1日正式发布Claude Sonnet 5,将其定位为目前最具agent能力的Sonnet模型,整体能力接近Opus 4.8。在SWE-bench Verified基准上得分92.4%,超越Opus 4.6的80.8%,定价却仅为Opus 4.8的一小部分。8月31日前API首发优惠为输入2美元、输出10美元(每百万tokens),9月1日起恢复至3美元、15美元。模型支持制定计划、调用浏览器和终端等工具,并默认启用网络安全防护机制。此次发布正值Anthropic秘密提交IPO招股书草案之际,旨在向开发者和企业客户展示其成本与性能曲线的平衡能力。

重点: 能力接近Opus但价格仅其一小部分

来源:展开 6 条收起 6 条

美国商务部解除Anthropic Fable 5与Mythos 5出口管制

美国商务部于7月1日正式解除对Anthropic顶级系统Claude Fable 5Mythos 5的出口管制,此前这两款模型因越狱担忧被禁数周。作为安抚监管机构的举措,Anthropic可能引入严格的KYC身份验证要求。同时,Claude Opus 4.8Haiku 4.5也在Microsoft Foundry上正式可用。此举表明白宫与Anthropic围绕安全与开放的分歧已取得阶段性平衡,Fable 5和Mythos 5将可继续向全球客户交付。

重点: Fable 5与Mythos 5同时解禁

来源:展开 9 条收起 9 条

OpenAI将ChatGPT未登录用户推理成本削减过半

OpenAI工程师本月早些时候宣布成功将ChatGPT未登录用户(访客流量)的推理成本削减超过一半,将支持该服务所需的活跃Nvidia GPU数量减少至仅几百块。具体的优化技术仍属机密,但此举为公司在数据中心扩张缓慢的情况下提供了关键的喘息空间。此外,工程师还修复了ChatGPT搜索数据管道中长期存在的崩溃问题。该方案验证了大规模推理工程的边际优化空间,对算力预算紧张的AI厂商具有示范意义。

重点: 访客流量推理成本降50%以上

来源:展开 2 条收起 2 条

月之暗面Kimi新一轮投前估值升至315亿美元,ARR突破3亿美元

月之暗面Kimi于近期完成上一轮200亿美元估值的融资交割,并启动新一轮融资,投前估值涨至315亿美元。截至6月中旬,月之暗面ARR(年度经常性收入)突破3亿美元,这是继今年3月ARR突破1亿美元、5月突破2亿美元后的又一商业化节点。估值在四个月内上涨约58%,体现资本市场对Kimi技术路线与商业化前景的高度认可。

重点: 4个月估值从200亿升至315亿美元

来源:展开 3 条收起 3 条

OpenAI发布GeneBench-Pro基准,GPT-5.6 Sol最高通过率28.7%

OpenAI发布GeneBench-Pro,面向计算生物学的研究级基准测试,用于评估AI智能体在处理模糊性、修订假设、选择分析方法等高层级判断能力。该基准包含129道题目,覆盖统计遗传学、群体遗传学、定量遗传学、调控组学、癌症基因组学等10个领域,采用合成数据构建以避免传统基准缺陷。OpenAI最强模型GPT-5.6 Sol在最高推理级别下通过率为28.7%(Pro模式31.5%),相比初代GeneBench时GPT-5不足5%有显著提升,但与人类专家20–40小时问题完成能力相比仍有较大差距。该基准首次系统量化AI在科研判断层面的能力短板,为后续模型训练提供更精准的能力坐标。

重点: 量化AI科研判断能力差距

来源:展开 5 条收起 5 条

变更与实践

Anthropic推出Claude Science科学家AI工作台

Anthropic推出Claude Science,面向科学家的AI工作台应用,将PubMed、Jupyter、R等分散工具整合到统一研究环境,支持多步骤文献分析与可审计成果物生成(3D蛋白结构、基因组浏览器轨道、化学结构等)。每个输出附带完整代码、环境与消息历史,确保可复现性。内置60多个预配置技能与连接器,覆盖基因组学、单细胞、蛋白组学等领域,并集成NVIDIA BioNeMo工具包。Beta版已面向Pro、Max、Team及Enterprise用户开放于macOS与Linux。

来源:展开 5 条收起 5 条

Google发布Nano Banana 2 Lite与Gemini Omni Flash图像视频模型

Google深夜双发两款AI模型。Nano Banana 2 Lite号称史上最快最便宜的文生图模型,4秒生成1K分辨率图像,单张成本约0.24元人民币(每千张0.034美元),已登陆Google AI Studio、Gemini API及企业代理平台。Gemini Omni Flash首次向开发者开放,支持文本、图像、视频混合输入,实现对话式视频编辑,定价0.10美元/秒。两款模型通过Interactions API串联,形成"文字→生图→生视频"流水线,支持最多连续三次迭代编辑。

来源:展开 8 条收起 8 条

Meta效仿SpaceX推出Meta Compute云算力业务

Meta正筹划推出名为Meta Compute的云基础设施业务,向外部客户出售AI算力及模型服务,包括新发布的闭源模型Muse Spark,直接对标AWS、Google Cloud和Microsoft Azure。此前Meta已承诺投入1829亿美元用于AI基础设施。Meta自有AI产品Meta AI与开源Llama系列尚未形成独立营收线,因此转而效仿CoreWeave模式销售"原始"算力。SpaceX旗下xAI已将Colossus 1数据中心算力分别出售给Anthropic、Google和Reflection AI,行业出现算力供应商化趋势。

来源:展开 2 条收起 2 条

英伟达开源ASPIRE机器人技能库

英伟达开源机器人技能库ASPIRE,将持续学习范式从梯度下降转向技能精炼。核心机制是让大模型(如GPT/Claude)扮演"机器人程序员":机器人执行任务时,ASPIRE将感知、导航、抓取、运动规划等过程记录为多模态执行轨迹,大模型通过回放诊断失败原因,修改控制程序后把经验沉淀为可复用的Skill,写入持续增长的技能库。实验覆盖三大基准,Robosuite双臂交接任务成功率从20%提升到92%论文由GEAR团队Jim Fan领衔。

来源:展开 1 条收起 1 条

安全与风险

Claude Code暗藏代码检测中国用户并封锁IP,Anthropic承认将完全回滚

Anthropic回应称Claude Code中存在暗藏的混淆代码,用于通过检测系统时区和API端点URL来识别中国用户,特别是配置了月之暗面等国产API地址的开发者。检测到的信息会被自动添加至系统提示词并发送至Anthropic服务器,Anthropic可据此实施模型降智、降低生成速率或封禁通过中转站反代Claude Pro/Max订阅的账号。该代码于3月份以"实验"名义部署,旨在防止转售商滥用账户及防范蒸馏攻击。被社区发现后,Anthropic工程师表示将于次日发布的新版本中完全回滚并删除相关检测代码。社区用户批评Anthropic未提前公告或在隐私协议中注明,担忧该机制未来可能被用于针对其他用户群体。

影响: 中国开发者通过中转服务账号可能被降智或封禁

建议: 相关用户应在版本更新前暂停通过中转服务使用

来源:展开 7 条收起 7 条

苹果iPhone 18 Pro大规模机密文件泄露,含A20 Pro与C2基带设计

勒索软件组织World Leaks入侵苹果印度供应商塔塔电子后,将涉及iPhone 18 Pro系列的敏感文件上传至暗网。泄露文件体量达数百GB,共超20万份,涵盖零部件与供应商清单、跌落测试照片,以及A20芯片和C2基带的相关图纸。路透社获取的文件显示,至少6份文件详细列出了iPhone 18 Pro各零部件对应的供应商,涉及主电路板芯片、电池及摄像头组件。泄露信息显示新机搭载采用WMCM封装技术的A20 Pro芯片(代号Borneo),VC均热板散热面积显著增大。苹果已通过DMCA投诉下架相关泄露内容。事件暴露出塔塔在印度制造快速扩张中管理能力的短板。

影响: iPhone 18 Pro核心设计在发布前被完整公开

建议: 苹果需重估供应链合同管理与泄密追溯机制

来源:展开 6 条收起 6 条

Barracuda研究显示AI生成垃圾邮件占比首次超过50%

Barracuda联合哥伦比亚大学、芝加哥大学发布研究,分析了2022年2月至2025年4月的恶意邮件样本。研究显示,截至2025年4月51%的垃圾邮件已由AI生成,首次超过人类编写的比例。这一趋势始于2022年11月ChatGPT发布,并在2024年3月出现大幅跳涨。此外,Hoxhunt监测显示2025年12月AI钓鱼邮件数量暴增14倍,占比从4%飙升至56%。AI主要通过提升邮件质量(减少拼写错误)来增强欺骗性,而非改变攻击策略。

影响: 传统邮件安全规则难应对AI生成的高质量钓鱼

建议: 企业邮件网关应部署AI语义识别与多模态异常检测

来源:展开 1 条收起 1 条

开源与工具

Cursor推出iOS原生应用,支持云端编程

Cursor于6月30日发布全新的iPhone和iPad应用,允许开发者直接从移动设备启动、监控和管理AI编程代理。随着软件开发从手写代码转向监督AI代理,用户现在可以随时随地审查、批准和合并代码变更。该应用仅能将桌面session接力到手机,无法独立启动agent session,但支持通过推送和锁屏实时活动提醒任务状态。同期OpenClaw也发布了原生iOS和Android应用,标志着AI助手正日益成为移动优先的工具。

适用场景: 开发者远程监控AI编程任务进展

来源:展开 5 条收起 5 条

腾讯云开源CubeSandbox面向AI Agent的轻量级沙箱

TencentCloud/CubeSandbox是腾讯云在GitHub开源的项目(Star 6.7k、Fork 558),定位为面向AI Agent的即时、并发、安全、轻量级沙箱。仓库包含CubeAPI、CubeMaster、Cubelet等多个子模块,累计407次提交。近期更新聚焦于生命周期管理:新增超时kill路径、settimeout/refresh接口与稳定的endat字段;修复hostdir挂载卡死问题的fail-fast机制。该项目被GitHub今日趋势榜收录。

适用场景: AI Agent安全沙箱隔离与生命周期管理

来源:展开 1 条收起 1 条

allenai/olmocr v0.4.0发布,强化PDF/图片OCR转换

allenai/olmocr是由Allen Institute for AI(AI2)旗下AllenNLP团队开发的开源工具包,专门用于将PDF及图片格式文档(PNG、JPEG)转换为干净的Markdown或纯文本,基于7B参数视觉语言模型,支持公式、表格、手写体及多栏复杂排版,并能自动去除页眉页脚,恢复自然阅读顺序。每百万页转换成本低于200美元。在最新v0.4.0中综合得分82.4,与Chandra OCR并列领先。

适用场景: PDF与图片批量OCR转换场景

来源:展开 1 条收起 1 条

数据与洞察

ChatGPT全球采用持续扩展,6个月日均消息量增长50%

OpenAI发布Signals消费数据,揭示ChatGPT全球采用持续扩展。用户使用深度与广度同步提升:注册六个月后日均消息量增长50%,尝试的不同任务类型翻倍。自2023年7月以来,各大洲周活跃用户均快速增长,非洲与亚洲相对增速领先,低人类发展指数(HDI)国家增幅最为显著。用户结构日趋多元,通常为女性名字的用户已占全球使用量多数;非英语用户超过活跃用户的一半,西班牙语、葡萄牙语、阿拉伯语为主要非英语语言,乌兹别克语、哈萨克语和缅甸语占比增幅最大。

数据: 6个月日均消息量+50%,非英语用户过半

意义: AI助手全球化加速,新兴市场成增长引擎

来源:展开 2 条收起 2 条

其他值得看

Etched估值50亿美元,专用推理ASIC芯片斩获10亿美元订单

AI芯片初创Etched累计融资8亿美元,获台积电代工芯片10亿美元订单。

来源:展开 4 条收起 4 条

OpenClaw开源AI代理正式登陆iOS与Android

开源AI代理进入移动端,开发生态持续扩展。

来源:展开 4 条收起 4 条

Godot基金会拒绝接受AI生成代码

开源游戏引擎政策变化,要求贡献必须来自人类。

来源:展开 3 条收起 3 条

Wayve以850亿美元估值启动8500万美元员工股票要约

自动驾驶独角兽估值再创新高,员工流动性提升。

来源:展开 2 条收起 2 条

xAI Grok 4.5内测版参数达1.5万亿

马斯克披露Grok 4.5进展,SpaceX与特斯拉内部测试。

来源:展开 1 条收起 1 条

Codex配额消耗修复后实际可用配额显著提升

OpenAI修复配额问题,5小时限额较故障期明显提高。

来源:展开 1 条收起 1 条

美国加州与Anthropic达成合作,政府部门可半价使用Claude

Claude产品深入美国地方政府采购体系。

来源:展开 1 条收起 1 条