07-03日报 | Anthropic自研AI芯片、微软MAI-Thinking-1、Sakana Fugu、阿里发现4种超导

来源:49 个引用生成:2026/07/04 06:06

内容

声明:完全使用AI生成,可能存在错误,需谨慎甄别。

摘要

2026-07-03 AI 领域呈现模型与算力双线推进格局。Anthropic确认与三星洽谈2纳米定制AI芯片并启动自研芯片;Microsoft发布完全自研推理模型MAI-Thinking-1,在AIME 2025数学基准取得97.0%成绩超过Claude Sonnet 4.6Sakana AI推出Fugu-Ultra多模型编排系统,在Terminal-Bench等基准上超越Claude Fable 5与GPT-5.5取得SOTA;阿里达摩院以仅28GPU小时预测出4种人类未知全新超导体;快手可灵AI正式落地30亿美元融资,估值达180亿美元,创全球视频大模型单轮融资纪录。

热点事件

Anthropic启动自研AI芯片,与三星洽谈2纳米定制方案

Anthropic据The Information报道正与三星洽谈定制AI芯片合作,计划采用三星2纳米制程与先进封装技术,目前处于方案规划阶段,尚未确定功能定位与算力规格。此举旨在实现计算堆栈多元化,Google、Amazon、Nvidia的现有芯片仍将是其硬件战略核心。本月初Anthropic还成功招揽OpenAI初代自研芯片团队核心成员Clive Chen,标志着其正式启动自研芯片路线,在硬件层与云厂商进一步解耦。

重点: Anthropic首次确认自研芯片,锁定三星2nm工艺

来源:展开 4 条收起 4 条

Microsoft发布完全自研推理模型MAI-Thinking-1

Microsoft推出首个完全自研的推理语言模型MAI-Thinking-1并非基于其他开发者模型的蒸馏或微调版本。该模型采用混合专家架构,总参数1万亿,每个token激活350亿参数,训练数据以人类生成为主,避免合成数据。在AIME 2025数学基准测试中取得97.0%成绩,超越Claude Sonnet 4.6与DeepSeek V3.2。该模型目前通过Microsoft Foundry提供私人预览,是微软摆脱第三方蒸馏、确立独立推理能力的标志性产品。

重点: 微软摆脱蒸馏路径,AIME 97.0%超Claude Sonnet 4.6

来源:展开 1 条收起 1 条

Sakana AI发布Fugu编排模型,多模型协同取得SOTA

Sakana AI发布两款编排模型FuguFugu-Ultra,通过单一API将任务委派给其他模型和智能体。Fugu专注离散任务如基础编码和聊天,Fugu-Ultra面向长时运行任务如大规模编码与研究,可调用Claude Opus 4.8、Gemini 3.1 Pro、GPT-5.5等多种大语言模型。在Terminal-Bench 2.1、LiveCodeBench、GPQA-Diamond等基准测试中,Fugu-Ultra超越Claude Fable 5与GPT-5.5,取得最先进成绩,展示了编排路线在性能与成本上的新可能。

重点: 编排模型首次在Terminal-Bench等超越旗舰闭源模型

来源:展开 1 条收起 1 条

阿里达摩院发现4种全新超导体,仅用28个GPU小时

阿里达摩院联合人大、中科院发布专攻超导材料发现的AI智能体ElementsClaw,仅用28个GPU小时扫描240万种稳定晶体,预测6.8万种可能超导,其中4种经实验确认为人类此前未知的全新超导体,分别为Hf₂₁Re₂₅(2.5K)、Zr₄VRe₇(3.5K)、HfZrRe₄(5.9K)、Zr₃ScRe₈(6.5K),命中率约40%远超自然界约3%的超导比例。核心Elements为10亿参数几何图神经网络,临界温度预测平均绝对误差0.99K、AUC达0.996。所有预测数据已对全球研究者开放。

重点: AI科研落地里程碑:低成本发现4种人类未知超导

来源:展开 2 条收起 2 条

快手可灵AI落地近30亿美元融资,估值180亿美元创纪录

快手旗下视频生成大模型可灵AI于7月2日正式落地近30亿美元融资,投后估值达180亿美元创下全球视频大模型公司单轮最大融资纪录。本轮由CPE源峰、国方创投、BlueFive、腾讯、中关村科学城基金、中信证券联合领投,并汇聚阿里云、百度等顶级产业资本及华策影视、芒果产业投资人等头部文娱产业方。作为后续进展,此轮融资较此前阶段大幅跃升,标志可灵AI独立商业化进程正式启动。

重点: 全球视频大模型单轮最大融资,独立估值180亿美元

来源:展开 1 条收起 1 条

变更与实践

Apple发布Safari MCP服务器,让AI编程代理直连Safari

WebKit在Safari Technology Preview 247中推出Safari MCP Server,可将Claude、Codex等AI编程代理直接连接到Safari窗口,获取页面DOM、网络请求、截图和控制台输出。内置16个工具(含screenshot、evaluate_javascript等),完全本地运行,不主动发起网络请求,无权访问Safari中的个人信息。已通过命令行注册MCP server方式开放,将显著降低Web开发者调试成本。

来源:展开 5 条收起 5 条

Google发布A2UI v0.9,促代理意图跨框架原生渲染

Google发布A2UI v0.9,作为框架无关的开放标准,让AI代理声明UI意图并在Web、移动和桌面端原生渲染,无需下发任意代码。v0.9核心转向是代理应使用应用现有设计系统组件,原Standard组件集更名为Basic。客户端推出共享web-core库及官方React渲染器,并升级Flutter、Lit、Angular渲染器;代理端A2UI Agent SDK支持版本协商、动态目录切换与流式增量解析,传输层支持MCP、WebSocket、REST、AG-UI和A2A 1.0。

来源:展开 1 条收起 1 条

Anthropic为Claude Enterprise上线管理分析与成本控制

AnthropicClaude Enterprise推出新版管理分析仪表板与成本控制功能。仪表板按用户与群组展示用量与支出,并将产出物创建、文件编辑、Skills与连接器使用费用并列呈现;Claude Code新增「使用情况」与「价值」标签页,Analytics chat支持自然语言查询并可导出图表,Analytics API支持按日期范围、团队、产品或模型筛选的编程化访问。管理员可为聊天、Cowork和Claude Code指定默认模型,支出阈值提醒在组织额度达75%和90%时分级通知。

来源:展开 1 条收起 1 条

字节跳动发布Seed2.0模型卡,聚焦长尾与复杂任务

字节跳动发布Seed2.0模型卡,围绕长尾知识、复杂指令遵循、推理、视觉理解和搜索等真实任务构建评估驱动方法。该卡片强调面向用户需求与复杂使用场景的设计思路,体现字节在多任务泛化能力上的最新积累,与同期Seedance视频模型、CVPR 2026入选成果形成模型-应用联动布局。

来源:展开 1 条收起 1 条

安全与风险

阿里巴巴全面禁用Claude Code,转用自研Qoder平台

阿里巴巴因担心后门风险,已全面禁止员工在工作中使用Anthropic的Claude Code,统一要求使用自家编程平台Qoder。尽管Anthropic此前已限制中国用户和实体的访问,Claude Code在中国程序员中仍非常受欢迎。此前Anthropic曾指控阿里巴巴蒸馏其模型,近日Claude Code又被发现包含检测用户是否来自中国的代码,双方紧张关系持续升级。该禁令将影响阿里数万工程师的日常工具链选择。

影响: 阿里数万员工的AI编程工具链迁移,短期影响开发效率

建议: 梳理跨境AI工具的供应链与数据出境合规风险,必要时引入替代方案

来源:展开 4 条收起 4 条

Linux 6.9起LUKS suspend密钥清除静默失效

Linux 6.9cryptsetup-suspend扩展在系统进入suspend to RAM前本应调用luksSuspend把LUKS磁盘加密主密钥从内存中清除,但该清钥动作在6.9之后静默失效,系统仍可正常睡眠与唤醒,但加密密钥仍留在通电的RAM中。Debian等发行版受影响,对仍带电的笔记本构成物理取证风险。开发者与用户需关注所用内核版本,必要时改用hibernate或手动禁用suspend。

影响: Linux笔记本用户:suspend状态下磁盘加密密钥可被物理取证

建议: 升级前确认发行版是否回滚该行为,对安全敏感场景改用hibernate替代suspend

来源:展开 1 条收起 1 条

开源与工具

OpenTelemetry正式毕业成为CNCF顶级项目

OpenTelemetryCNCF宣布正式毕业,成为该基金会最高成熟度级别项目,被认定可用于企业生产环境。该项目由OpenTracing和OpenCensus合并,提供标准化API、SDK和语义约定,统一采集、处理和导出指标、日志和链路追踪等遥测数据,开发者一次埋点即可对接多种后端避免供应商锁定。此次毕业使其与Kubernetes、Prometheus、Envoy、Istio、Dapper并列成为CNCF顶级项目,在智能体AI时代为LLM和自主AI代理的巨量遥测奠定监控基础。

适用场景: 企业级可观测性栈建设、AI Agent和大模型应用的链路追踪

来源:展开 1 条收起 1 条

Hardwood 1.0发布,零强制依赖JVM Apache Parquet处理

Hardwood正式发布1.0版本,作为JVM环境下高效读取Apache Parquet的开源库。核心优势包括几乎零强制依赖(利用Java 9起的内置日志抽象)、多线程页面解码充分利用CPU资源,以及面向通用记录的row reader API和高吞吐分析的column reader API。在8 vCPU环境下基准吞吐量达每秒1650万行,社区已聚集20位开源贡献者,写入支持已列入未来路线图。

适用场景: JVM数据分析、降低供应链依赖风险的高吞吐ETL负载

来源:展开 1 条收起 1 条

Genesis AI开源Genesis World 1.0,机器人评测耗时压缩350倍

因"机器人炒番茄炒蛋"视频走红的Genesis AI正式开源核心平台Genesis World 1.0,包含Genesis World物理仿真平台Quadrants跨平台GPU编译器Nyx写实渲染器。平台可将真实世界需200多小时的机器人评测任务压缩至0.5小时内完成,仿真结果与真实硬件运行相关性达89%,定位为机器人基础模型的评测与迭代引擎,有望打破Physical AI领域模型评测效率瓶颈。

适用场景: 具身智能/机器人学习研究与仿真、模型评测流水线

来源:展开 1 条收起 1 条

阿里开源Page Agent,让大模型通过FlatDomTree精准操作网页

阿里巴巴开源JavaScript客户端库Page Agent,采用DOM脱水技术直接将冗杂DOM树压缩为轻量化的FlatDomTree文本映射,让大模型无需依赖截图或多模态分析即可精准完成按钮点击、表单输入等操作。工具内嵌于网页环境,天然继承Cookie与登录凭证,兼容所有支持标准接口的大语言模型。已以MIT协议在GitHub开源,适用于SaaS智能副驾、自动化数据采集等场景,但涉及支付等高安全操作仍需服务端校验。

适用场景: SaaS智能副驾、网页自动化采集、企业内部系统Agent化

来源:展开 2 条收起 2 条

Manticore改写ONNX路径,CPU端embeddings提速14倍

Manticore搜索/向量检索系统将embeddings生成链路改写至ONNX路径后,在CPU上实现14倍提速。社区进一步提出可用AVX512_BF16指令集或OpenVINO再降2-3倍延迟,并讨论batching在CPU推理中从GEMV加速到GEMM的优势。该项目为无GPU资源的向量检索场景提供显著的成本与延迟优势。

适用场景: 无GPU资源的向量检索部署、本地搜索系统加速

来源:展开 1 条收起 1 条

数据与洞察

Google 2025年用电量同比增长37%,AI算力扩张拉高能耗

Google在最新可持续发展报告中承认,自2019年以来用电量增长逾250%,2025年又增长37%。2025年Google数据中心消耗超4200万MWh电力,相当于新西兰、丹麦、尼日利亚等国全国用电量。增长主要来自Google Cloud、YouTube视频串流及AI基础设施的建造与运营,叠加此前披露的总排放同比上升25%,AI算力扩张正成为大型科技公司净零目标兑现的关键阻力。

数据: Google 2025年用电量同比+37%,自2019以来累计增长超250%

意义: AI基础设施能耗曲线进入陡升段,倒逼云计算厂商加大可再生能源与低碳材料投资

来源:展开 2 条收起 2 条

Anthropic将月之暗面Kimi K2.7纳入对标名单

Anthropic在最新公告中将Claude Opus 4.8OpenAI GPT-5.5中国月之暗面Kimi K2.7并列为同样具备零日漏洞发现能力的模型,中国大模型首次进入Anthropic对标名单。背景是海外采购中国模型的理由已从廉价替代转向高性价比+技术领先,Coinbase、Airbnb、Cloudflare、Notion等公司已先后接入千问、DeepSeek、Kimi等国产模型。Kimi 2026年6月ARR较3月再翻三倍,新一轮估值达315亿美元

数据: Kimi K2.7首次与GPT-5.5/Claude Opus 4.8并列;6月ARR较3月再翻三倍

意义: 中国前沿模型正式进入海外安全/能力对标基准,模型输出结构变化推动合规与采购策略调整

来源:展开 1 条收起 1 条

国内五大AI厂商价格战降幅最高99%,Token计量向买方倾斜

字节与阿里等五家国内AI厂商开始集体大降价,降幅最高达99%。买方端,Uber四个月烧光全年AI编码预算并设月上限1500美元,微软财年末取消数千工程师Claude Code许可,GitHub Copilot改按token计费后大批用户退订。卖方端,OpenAI 2026年预亏140亿美元,Anthropic月算力成本12.5亿美元,亚马逊亦转按token向Anthropic结算,裸token计费正被踢出前台、退回后台。

数据: 最高降幅99%;OpenAI 2026预亏140亿美元,Anthropic月算力成本12.5亿美元

意义: 买方压缩与厂商亏损并存,Token计费或被效果/订阅混合模式替代

来源:展开 2 条收起 2 条

瑞银报告:AI热潮拉动2025年全球新增近百万百万富翁

瑞银最新财富统计报告指出,AI热潮拉动全球股市上行直接推动富豪群体规模大幅扩张。全球个人财富整体上涨10.8%亿万富豪资产平均增幅达25%;全球亿万富翁数量同比增长13%3302人,超千亿美元梯队有19人,绝大多数定居美国。2025年全球新增近百万名百万美元富翁,总规模突破5750万。但报告同时强调全球财富分配不均进一步加剧,仅占全球人口0.001%的人掌握财富达底层半数人口的三倍。

数据: 全球亿万富翁3302人增13%;富豪资产平均增25%;百万富翁新增近100万

意义: AI市值效应对顶层财富虹吸已显著放大,但难以转化为广泛民生改善信号

来源:展开 1 条收起 1 条

Meta自研Watermelon模型据称基准追平GPT-5.5

Meta超级智能负责人Alexandr Wang表示,其即将推出的模型Watermelon在AI基准测试中已追平OpenAI的GPT-5.5。该模型仍在训练中,据称使用的计算量比Muse Spark高出一个数量级,Meta尚未公布发布时间。背景是CEO扎克伯格在内部全员会上承认AI智能体进展"没有以预期方式加速",年内已裁员约8000人并将7000人重新分配至Agent等AI团队;Watermelon的进度将决定Meta能否在3-6个月内兑现AI投资回报。

数据: Watermelon基准追平GPT-5.5;Meta年内裁员8000人、转岗7000人

意义: Meta在模型指标上能否追平头部厂商,将验证其大规模重组的实质效果

来源:展开 3 条收起 3 条

其他值得看

苹果上调折叠屏iPhone备货至1000万台

苹果被曝要求供应商为折叠iPhone准备千万级零部件,备货预期大幅上调。

来源:展开 2 条收起 2 条

字节豆包手机硬件负责人林夕离职

字节Ocean核心硬件负责人林夕正式离职,豆包AI手机项目进入调整期。

来源:展开 1 条收起 1 条

Anthropic为Fable 5引入新分类器与越狱评级量表

Anthropic为重新部署的Fable 5引入更严格网络安全分类器和Cyber Jailbreak Severity量表。

来源:展开 1 条收起 1 条

日本最高法院裁定AI不能作为专利发明人

日本最高法院维持DABUS案裁定:专利申请必须列明人类发明人。

来源:展开 2 条收起 2 条

证监会同意宇树科技科创板IPO注册申请

宇树科技科创板IPO注册获批,拟募资42亿元用于机器人研发项目。

来源:展开 1 条收起 1 条

谷歌Gemini Omni Flash登顶Video Arena盲测

Gemini Omni Flash以1404 Elo登顶Video Arena,领先字节Seedance达101 Elo。

来源:展开 1 条收起 1 条

Poolside发布Laguna XS 2.1智能体编程模型

330亿参数MoE模型,SWE-bench Multilingual提升5.4分至63.1%。

来源:展开 1 条收起 1 条

硅谷倡议者主张本地AI权利需法律安全港

"Right to Local Intelligence"倡议主张各州为本地AI所有权提供法律安全港。

来源:展开 1 条收起 1 条