内容
声明:完全使用AI生成,可能存在错误,需谨慎甄别。
摘要
2026-07-03 AI 领域呈现模型与算力双线推进格局。Anthropic确认与三星洽谈2纳米定制AI芯片并启动自研芯片;Microsoft发布完全自研推理模型MAI-Thinking-1,在AIME 2025数学基准取得97.0%成绩超过Claude Sonnet 4.6;Sakana AI推出Fugu-Ultra多模型编排系统,在Terminal-Bench等基准上超越Claude Fable 5与GPT-5.5取得SOTA;阿里达摩院以仅28GPU小时预测出4种人类未知全新超导体;快手可灵AI正式落地30亿美元融资,估值达180亿美元,创全球视频大模型单轮融资纪录。
热点事件
Anthropic启动自研AI芯片,与三星洽谈2纳米定制方案
Anthropic据The Information报道正与三星洽谈定制AI芯片合作,计划采用三星2纳米制程与先进封装技术,目前处于方案规划阶段,尚未确定功能定位与算力规格。此举旨在实现计算堆栈多元化,Google、Amazon、Nvidia的现有芯片仍将是其硬件战略核心。本月初Anthropic还成功招揽OpenAI初代自研芯片团队核心成员Clive Chen,标志着其正式启动自研芯片路线,在硬件层与云厂商进一步解耦。
重点: Anthropic首次确认自研芯片,锁定三星2nm工艺
来源:展开 4 条收起 4 条
- Anthropic探讨与三星合作定制AI芯片(TLTD)
- Anthropic 据悉正与三星洽谈定制人工智能芯片(Readhub - 每日早报)
- AI 芯片自研大军再添新援:Anthropic 启动早期开发,拟采用三星 2nm 工艺(AI新闻资讯)
- Anthropic 启动自研 AI 芯片早期开发,拟采用三星 2 纳米工艺(极客公园)
Microsoft发布完全自研推理模型MAI-Thinking-1
Microsoft推出首个完全自研的推理语言模型MAI-Thinking-1,并非基于其他开发者模型的蒸馏或微调版本。该模型采用混合专家架构,总参数1万亿,每个token激活350亿参数,训练数据以人类生成为主,避免合成数据。在AIME 2025数学基准测试中取得97.0%成绩,超越Claude Sonnet 4.6与DeepSeek V3.2。该模型目前通过Microsoft Foundry提供私人预览,是微软摆脱第三方蒸馏、确立独立推理能力的标志性产品。
重点: 微软摆脱蒸馏路径,AIME 97.0%超Claude Sonnet 4.6
来源:展开 1 条收起 1 条
- Microsoft 发布自研推理模型 MAI-Thinking-1,不再依赖第三方蒸馏(The Batch | DeepLearning.AI | AI News & Insights)
Sakana AI发布Fugu编排模型,多模型协同取得SOTA
Sakana AI发布两款编排模型Fugu与Fugu-Ultra,通过单一API将任务委派给其他模型和智能体。Fugu专注离散任务如基础编码和聊天,Fugu-Ultra面向长时运行任务如大规模编码与研究,可调用Claude Opus 4.8、Gemini 3.1 Pro、GPT-5.5等多种大语言模型。在Terminal-Bench 2.1、LiveCodeBench、GPQA-Diamond等基准测试中,Fugu-Ultra超越Claude Fable 5与GPT-5.5,取得最先进成绩,展示了编排路线在性能与成本上的新可能。
重点: 编排模型首次在Terminal-Bench等超越旗舰闭源模型
来源:展开 1 条收起 1 条
- Sakana AI 发布 Fugu 系列模型,通过编排多模型协作实现顶尖性能(The Batch | DeepLearning.AI | AI News & Insights)
阿里达摩院发现4种全新超导体,仅用28个GPU小时
阿里达摩院联合人大、中科院发布专攻超导材料发现的AI智能体ElementsClaw,仅用28个GPU小时扫描240万种稳定晶体,预测6.8万种可能超导,其中4种经实验确认为人类此前未知的全新超导体,分别为Hf₂₁Re₂₅(2.5K)、Zr₄VRe₇(3.5K)、HfZrRe₄(5.9K)、Zr₃ScRe₈(6.5K),命中率约40%远超自然界约3%的超导比例。核心Elements为10亿参数几何图神经网络,临界温度预测平均绝对误差0.99K、AUC达0.996。所有预测数据已对全球研究者开放。
重点: AI科研落地里程碑:低成本发现4种人类未知超导
来源:展开 2 条收起 2 条
快手可灵AI落地近30亿美元融资,估值180亿美元创纪录
快手旗下视频生成大模型可灵AI于7月2日正式落地近30亿美元融资,投后估值达180亿美元,创下全球视频大模型公司单轮最大融资纪录。本轮由CPE源峰、国方创投、BlueFive、腾讯、中关村科学城基金、中信证券联合领投,并汇聚阿里云、百度等顶级产业资本及华策影视、芒果产业投资人等头部文娱产业方。作为后续进展,此轮融资较此前阶段大幅跃升,标志可灵AI独立商业化进程正式启动。
重点: 全球视频大模型单轮最大融资,独立估值180亿美元
来源:展开 1 条收起 1 条
变更与实践
Apple发布Safari MCP服务器,让AI编程代理直连Safari
WebKit在Safari Technology Preview 247中推出Safari MCP Server,可将Claude、Codex等AI编程代理直接连接到Safari窗口,获取页面DOM、网络请求、截图和控制台输出。内置16个工具(含screenshot、evaluate_javascript等),完全本地运行,不主动发起网络请求,无权访问Safari中的个人信息。已通过命令行注册MCP server方式开放,将显著降低Web开发者调试成本。
来源:展开 5 条收起 5 条
- 为 Web 开发者推出 Safari MCP 服务器(Andrej Karpathy Curated RSS)
- 🤔 Safari MCP server:LLM 跨浏览器测网页,仍卡 Apple 生态(News Hacker | 极客洞察)
- 苹果 Safari 预览版新增 MCP 服务,AI 智能体助力网页开发调试(AI新闻资讯)
- 苹果将 Safari 打造成可供 AI 智能体控制的平台(The New Stack)
- Apple 发布 Safari MCP 服务器供 Web 开发者使用(TLTD)
Google发布A2UI v0.9,促代理意图跨框架原生渲染
Google发布A2UI v0.9,作为框架无关的开放标准,让AI代理声明UI意图并在Web、移动和桌面端原生渲染,无需下发任意代码。v0.9核心转向是代理应使用应用现有设计系统组件,原Standard组件集更名为Basic。客户端推出共享web-core库及官方React渲染器,并升级Flutter、Lit、Angular渲染器;代理端A2UI Agent SDK支持版本协商、动态目录切换与流式增量解析,传输层支持MCP、WebSocket、REST、AG-UI和A2A 1.0。
来源:展开 1 条收起 1 条
Anthropic为Claude Enterprise上线管理分析与成本控制
Anthropic为Claude Enterprise推出新版管理分析仪表板与成本控制功能。仪表板按用户与群组展示用量与支出,并将产出物创建、文件编辑、Skills与连接器使用费用并列呈现;Claude Code新增「使用情况」与「价值」标签页,Analytics chat支持自然语言查询并可导出图表,Analytics API支持按日期范围、团队、产品或模型筛选的编程化访问。管理员可为聊天、Cowork和Claude Code指定默认模型,支出阈值提醒在组织额度达75%和90%时分级通知。
来源:展开 1 条收起 1 条
- Anthropic 为管理员提供更透明的 Claude 支出可视化和控制能力(Claude Blog)
字节跳动发布Seed2.0模型卡,聚焦长尾与复杂任务
字节跳动发布Seed2.0模型卡,围绕长尾知识、复杂指令遵循、推理、视觉理解和搜索等真实任务构建评估驱动方法。该卡片强调面向用户需求与复杂使用场景的设计思路,体现字节在多任务泛化能力上的最新积累,与同期Seedance视频模型、CVPR 2026入选成果形成模型-应用联动布局。
来源:展开 1 条收起 1 条
- 字节跳动发布Seed2.0模型卡(TLTD)
安全与风险
阿里巴巴全面禁用Claude Code,转用自研Qoder平台
阿里巴巴因担心后门风险,已全面禁止员工在工作中使用Anthropic的Claude Code,统一要求使用自家编程平台Qoder。尽管Anthropic此前已限制中国用户和实体的访问,Claude Code在中国程序员中仍非常受欢迎。此前Anthropic曾指控阿里巴巴蒸馏其模型,近日Claude Code又被发现包含检测用户是否来自中国的代码,双方紧张关系持续升级。该禁令将影响阿里数万工程师的日常工具链选择。
影响: 阿里数万员工的AI编程工具链迁移,短期影响开发效率
建议: 梳理跨境AI工具的供应链与数据出境合规风险,必要时引入替代方案
来源:展开 4 条收起 4 条
- 阿里巴巴禁止员工使用 Claude Code(奇客Solidot–传递最新科技情报)
- 阿里巴巴内部“反向禁用”:全面下架 Claude 系列 AI 工具(AI新闻资讯)
- 阿里内部全面禁用 Claude Code(Readhub - 每日早报)
- 🤨 阿里巴巴拟禁用 Claude Code:后门争议、绕过限制与开源替代(News Hacker | 极客洞察)
Linux 6.9起LUKS suspend密钥清除静默失效
Linux 6.9起cryptsetup-suspend扩展在系统进入suspend to RAM前本应调用luksSuspend把LUKS磁盘加密主密钥从内存中清除,但该清钥动作在6.9之后静默失效,系统仍可正常睡眠与唤醒,但加密密钥仍留在通电的RAM中。Debian等发行版受影响,对仍带电的笔记本构成物理取证风险。开发者与用户需关注所用内核版本,必要时改用hibernate或手动禁用suspend。
影响: Linux笔记本用户:suspend状态下磁盘加密密钥可被物理取证
建议: 升级前确认发行版是否回滚该行为,对安全敏感场景改用hibernate替代suspend
来源:展开 1 条收起 1 条
- ⚠️ Linux 6.9 起 LUKS suspend 不再清除内存密钥(News Hacker | 极客洞察)
开源与工具
OpenTelemetry正式毕业成为CNCF顶级项目
OpenTelemetry由CNCF宣布正式毕业,成为该基金会最高成熟度级别项目,被认定可用于企业生产环境。该项目由OpenTracing和OpenCensus合并,提供标准化API、SDK和语义约定,统一采集、处理和导出指标、日志和链路追踪等遥测数据,开发者一次埋点即可对接多种后端避免供应商锁定。此次毕业使其与Kubernetes、Prometheus、Envoy、Istio、Dapper并列成为CNCF顶级项目,在智能体AI时代为LLM和自主AI代理的巨量遥测奠定监控基础。
适用场景: 企业级可观测性栈建设、AI Agent和大模型应用的链路追踪
来源:展开 1 条收起 1 条
Hardwood 1.0发布,零强制依赖JVM Apache Parquet处理
Hardwood正式发布1.0版本,作为JVM环境下高效读取Apache Parquet的开源库。核心优势包括几乎零强制依赖(利用Java 9起的内置日志抽象)、多线程页面解码充分利用CPU资源,以及面向通用记录的row reader API和高吞吐分析的column reader API。在8 vCPU环境下基准吞吐量达每秒1650万行,社区已聚集20位开源贡献者,写入支持已列入未来路线图。
适用场景: JVM数据分析、降低供应链依赖风险的高吞吐ETL负载
来源:展开 1 条收起 1 条
Genesis AI开源Genesis World 1.0,机器人评测耗时压缩350倍
因"机器人炒番茄炒蛋"视频走红的Genesis AI正式开源核心平台Genesis World 1.0,包含Genesis World物理仿真平台、Quadrants跨平台GPU编译器和Nyx写实渲染器。平台可将真实世界需200多小时的机器人评测任务压缩至0.5小时内完成,仿真结果与真实硬件运行相关性达89%,定位为机器人基础模型的评测与迭代引擎,有望打破Physical AI领域模型评测效率瓶颈。
适用场景: 具身智能/机器人学习研究与仿真、模型评测流水线
来源:展开 1 条收起 1 条
阿里开源Page Agent,让大模型通过FlatDomTree精准操作网页
阿里巴巴开源JavaScript客户端库Page Agent,采用DOM脱水技术直接将冗杂DOM树压缩为轻量化的FlatDomTree文本映射,让大模型无需依赖截图或多模态分析即可精准完成按钮点击、表单输入等操作。工具内嵌于网页环境,天然继承Cookie与登录凭证,兼容所有支持标准接口的大语言模型。已以MIT协议在GitHub开源,适用于SaaS智能副驾、自动化数据采集等场景,但涉及支付等高安全操作仍需服务端校验。
适用场景: SaaS智能副驾、网页自动化采集、企业内部系统Agent化
来源:展开 2 条收起 2 条
Manticore改写ONNX路径,CPU端embeddings提速14倍
Manticore搜索/向量检索系统将embeddings生成链路改写至ONNX路径后,在CPU上实现14倍提速。社区进一步提出可用AVX512_BF16指令集或OpenVINO再降2-3倍延迟,并讨论batching在CPU推理中从GEMV加速到GEMM的优势。该项目为无GPU资源的向量检索场景提供显著的成本与延迟优势。
适用场景: 无GPU资源的向量检索部署、本地搜索系统加速
来源:展开 1 条收起 1 条
- 🚀 Manticore 重写 ONNX 路径:CPU 端 embeddings 提速 14 ×(News Hacker | 极客洞察)
数据与洞察
Google 2025年用电量同比增长37%,AI算力扩张拉高能耗
Google在最新可持续发展报告中承认,自2019年以来用电量增长逾250%,2025年又增长37%。2025年Google数据中心消耗超4200万MWh电力,相当于新西兰、丹麦、尼日利亚等国全国用电量。增长主要来自Google Cloud、YouTube视频串流及AI基础设施的建造与运营,叠加此前披露的总排放同比上升25%,AI算力扩张正成为大型科技公司净零目标兑现的关键阻力。
数据: Google 2025年用电量同比+37%,自2019以来累计增长超250%
意义: AI基础设施能耗曲线进入陡升段,倒逼云计算厂商加大可再生能源与低碳材料投资
来源:展开 2 条收起 2 条
- 阅读我们的第11份年度环境报告(The Keyword)
- Google 的 2025 年用电量增长了 37%(奇客Solidot–传递最新科技情报)
Anthropic将月之暗面Kimi K2.7纳入对标名单
Anthropic在最新公告中将Claude Opus 4.8、OpenAI GPT-5.5与中国月之暗面Kimi K2.7并列为同样具备零日漏洞发现能力的模型,中国大模型首次进入Anthropic对标名单。背景是海外采购中国模型的理由已从廉价替代转向高性价比+技术领先,Coinbase、Airbnb、Cloudflare、Notion等公司已先后接入千问、DeepSeek、Kimi等国产模型。Kimi 2026年6月ARR较3月再翻三倍,新一轮估值达315亿美元。
数据: Kimi K2.7首次与GPT-5.5/Claude Opus 4.8并列;6月ARR较3月再翻三倍
意义: 中国前沿模型正式进入海外安全/能力对标基准,模型输出结构变化推动合规与采购策略调整
来源:展开 1 条收起 1 条
国内五大AI厂商价格战降幅最高99%,Token计量向买方倾斜
字节与阿里等五家国内AI厂商开始集体大降价,降幅最高达99%。买方端,Uber四个月烧光全年AI编码预算并设月上限1500美元,微软财年末取消数千工程师Claude Code许可,GitHub Copilot改按token计费后大批用户退订。卖方端,OpenAI 2026年预亏140亿美元,Anthropic月算力成本12.5亿美元,亚马逊亦转按token向Anthropic结算,裸token计费正被踢出前台、退回后台。
数据: 最高降幅99%;OpenAI 2026预亏140亿美元,Anthropic月算力成本12.5亿美元
意义: 买方压缩与厂商亏损并存,Token计费或被效果/订阅混合模式替代
来源:展开 2 条收起 2 条
- 国内五大厂商开启大模型价格战降幅高达99%(AI洞察日报 RSS Feed)
- AI 成本失控警报:大厂相继祭出“限流令”,旗舰模型成了“奢侈品”(AI新闻资讯)
瑞银报告:AI热潮拉动2025年全球新增近百万百万富翁
瑞银最新财富统计报告指出,AI热潮拉动全球股市上行直接推动富豪群体规模大幅扩张。全球个人财富整体上涨10.8%,亿万富豪资产平均增幅达25%;全球亿万富翁数量同比增长13%达3302人,超千亿美元梯队有19人,绝大多数定居美国。2025年全球新增近百万名百万美元富翁,总规模突破5750万。但报告同时强调全球财富分配不均进一步加剧,仅占全球人口0.001%的人掌握财富达底层半数人口的三倍。
数据: 全球亿万富翁3302人增13%;富豪资产平均增25%;百万富翁新增近100万
意义: AI市值效应对顶层财富虹吸已显著放大,但难以转化为广泛民生改善信号
来源:展开 1 条收起 1 条
Meta自研Watermelon模型据称基准追平GPT-5.5
Meta超级智能负责人Alexandr Wang表示,其即将推出的模型Watermelon在AI基准测试中已追平OpenAI的GPT-5.5。该模型仍在训练中,据称使用的计算量比Muse Spark高出一个数量级,Meta尚未公布发布时间。背景是CEO扎克伯格在内部全员会上承认AI智能体进展"没有以预期方式加速",年内已裁员约8000人并将7000人重新分配至Agent等AI团队;Watermelon的进度将决定Meta能否在3-6个月内兑现AI投资回报。
数据: Watermelon基准追平GPT-5.5;Meta年内裁员8000人、转岗7000人
意义: Meta在模型指标上能否追平头部厂商,将验证其大规模重组的实质效果
来源:展开 3 条收起 3 条
- Meta Watermelon模型据称追平GPT-5.5基准(TLTD)
- 扎克伯格向员工坦言AI智能体进展未达预期(TechCrunch)
- Meta CEO 扎克伯格称 AI 智能体开发未达预期(Readhub - 每日早报)
其他值得看
苹果上调折叠屏iPhone备货至1000万台
苹果被曝要求供应商为折叠iPhone准备千万级零部件,备货预期大幅上调。
来源:展开 2 条收起 2 条
- 苹果今明两年拟推出至少 5 款新机,折叠屏 iPhone 备货预期猛增至 1000 万台(极客公园)
- 近年来最密集发布节奏:消息称苹果今明两年拟推出至少 5 款 iPhone 新机(Readhub - 每日早报)
字节豆包手机硬件负责人林夕离职
字节Ocean核心硬件负责人林夕正式离职,豆包AI手机项目进入调整期。
来源:展开 1 条收起 1 条
- 字节豆包 AI 手机项目生变:硬件负责人离职,项目进入“调整期”(AI新闻资讯)
Anthropic为Fable 5引入新分类器与越狱评级量表
Anthropic为重新部署的Fable 5引入更严格网络安全分类器和Cyber Jailbreak Severity量表。
来源:展开 1 条收起 1 条
日本最高法院裁定AI不能作为专利发明人
日本最高法院维持DABUS案裁定:专利申请必须列明人类发明人。
来源:展开 2 条收起 2 条
- ⚖️ 日本最高法院裁定:AI 不能做专利发明人(News Hacker | 极客洞察)
- 日本最高法院裁决 AI 不能被列为专利申请的发明人(奇客Solidot–传递最新科技情报)
证监会同意宇树科技科创板IPO注册申请
宇树科技科创板IPO注册获批,拟募资42亿元用于机器人研发项目。
来源:展开 1 条收起 1 条
- 证监会同意宇树科技科创板 IPO 注册申请(极客公园)
谷歌Gemini Omni Flash登顶Video Arena盲测
Gemini Omni Flash以1404 Elo登顶Video Arena,领先字节Seedance达101 Elo。
来源:展开 1 条收起 1 条
Poolside发布Laguna XS 2.1智能体编程模型
330亿参数MoE模型,SWE-bench Multilingual提升5.4分至63.1%。
来源:展开 1 条收起 1 条
硅谷倡议者主张本地AI权利需法律安全港
"Right to Local Intelligence"倡议主张各州为本地AI所有权提供法律安全港。
来源:展开 1 条收起 1 条
- 🤨 本地 AI 权利:争取开源模型本地运行安全港(News Hacker | 极客洞察)