08-21日报 | 墨奇智能发布Agentic-Native具身模型、Anthropic Claude智能体平台多项能力正式发布

来源:45 个引用生成:2026/08/22 06:06

内容

声明:完全使用AI生成,可能存在错误,需谨慎甄别。

摘要

2026-08-21 AI领域呈现多线并进格局,值得关注的信息:墨奇智能在WRC 2026首发Agentic-Native路线与MoRA模型,演示MORPHI KINO机器人约15分钟无人工指挥的家务长程任务;Anthropic将Claude Platform的Computer Use、Skills API、Files API全面推出GA并上线Browser Use;Stripe宣布收购AI模型路由平台OpenRouter,估值约75亿美元,推动支付与推理账本走向合流;Generalist AI发布一次物理提示即学会新技能的具身基础模型GEN-1.5;OpenAI部署首批NVIDIA Vera Rubin机柜用于下一代前沿预训练;小红书开源MoE大模型dots3-note preview,DeepSeek推出实验性多模态模型deepseek-v4-flash-vision-exp;安全侧OpenAI因网络安全风险暂停部分强化学习训练,Apollo樱花网络接连确认数据泄露事件。

热点事件

墨奇智能亮相WRC 2026首发MoRA架构与MORPHI KINO机器人演示长程家务

墨奇智能在2026世界机器人大会首次公开亮相,同步发布自研具身模型架构MoRA与轮式机器人本体MORPHI KINO,现场演示了约15分钟无人工指挥的家居长程任务,包括桌面收纳、冰箱检查与补货、衣物烘干取出码放等连续操作。针对传统"高层规划、低层执行"分层架构在长程任务中频繁断片的问题,墨奇提出Agentic-Native技术路线,将目标维护、多粒度记忆与进度判断下沉到System 1执行层,由System 2负责意图理解与异常兜底。硬件上KINO配备四舵轮底盘、双臂7自由度、5kg单臂负载及双块540Wh热插拔电池,续航不低于4小时。数据方面,墨奇以MORPHI Sense Kit采集酒店与公寓真实场景数据,已积累约3万小时,计划2026年底扩充至15万至20万小时。

重点: 具身智能长程任务从分层架构转向Agentic-Native执行路线

来源:展开 2 条收起 2 条

Anthropic 全面推出 Claude Platform 四大智能体工具

2026年8月21日 Anthropic 对 Claude Platform 进行重大升级,宣布 Computer Use、Skills API、Files API 全面进入 GA 阶段,并同步上线全新 Browser Use 工具。Computer Use 升级支持单轮多次连续动作并符合 HIPAA 标准,可在签署 BAA 后用于受监管医疗负载;与此前版本相比,Files API 速率提升 5 倍至 500 RPM 并提供 1TB 组织存储,Skills API 引入带版本管理的可复用流程与沙盒执行能力。Browser Use 面向网页结构解析与精准操作,Computer Use 与 Browser Use 即将登陆 Google Cloud Vertex AI,开发者也可继续通过 Microsoft Foundry 调用。AG-UI 适配器可将聊天线程映射到托管会话并流式输出文本、工具调用与思考过程,整体赋能企业构建生产级智能体。

重点: Claude智能体平台关键能力全面GA并新增Browser Use

来源:展开 4 条收起 4 条

Stripe收购OpenRouter布局模型路由与推理支付基础设施

Stripe宣布收购AI模型路由平台OpenRouter,交易估值约75亿美元,是Stripe迄今最大的一笔收购。此举意在把Token开销管控、跨模型请求路由能力纳入支付体系,让支付与推理账本走向合流。在致投资者信中,Stripe把收购日期视为AI加速进入企业的新节点,提出为AI智能体建设金融基础设施的战略,平台token使用量年内以每周约9%复合增长。Stripe正从支付公司向AI经济底层基础设施延伸,OpenRouter可支持跨模型请求路由。报道在估值与战略侧重上略有差异:TechCrunch等强调75亿美元估值与推理成本管理,而其他分析更突出Stripe把智能体支付与模型路由整合的长期布局。

重点: Stripe以约75亿美元收购OpenRouter整合AI推理支付

来源:展开 2 条收起 2 条

Generalist AI发布GEN-1.5:机器人一次性学习新范式

Generalist AI正式发布具身基础模型GEN-1.5,主张机器人可凭单次3–12秒物理演示完成新技能获取,无需梯度更新或微调,约半分钟内即可自主复现并组合执行连续操作。团队经8个多月连续预训练,未显式设计元学习或In-Context目标,One-shot能力在大量真实物理交互中自然涌现。在10类任务的一次Physical Prompt、零梯度更新测试中,平均成功率59%;再补5分钟数据+10步梯度更新后提升至83%。该范式被类比为机器人的GPT-2或GPT-3时刻,并被称作"物理版Prompt Engineering",标志着从脚本化行为向"看着学"现场任务学习的跨越。

重点: 机器人一次性物理提示学习能力自然涌现

来源:展开 2 条收起 2 条

OpenAI 首批 NVIDIA Vera Rubin 机柜上线下一代预训练

OpenAI 已安装并运行首批 NVIDIA Vera Rubin 机柜以承载训练栈,明确指向下一代前沿预训练。Vera Rubin 是 NVIDIA 新一代 GPU 平台,本次部署被评价为 OpenAI 与 NVIDIA 合作的里程碑,罕见地提供关于前沿预训练规模化进展的公开信号。此前双方长期基于 Hopper/Blackwell 架构展开训练,Vera Rubin 的上线意味着下一代前沿模型的算力底座已就绪,为后续更大规模预训练实验奠定基础。

重点: OpenAI部署Vera Rubin机柜支撑下一代前沿预训练

来源:展开 1 条收起 1 条

变更与实践

Agent Harness成本优化:百炼账单降低88%实战

阿里百炼(DashScope)平台上 qwen3.7-max 模型驱动的故障诊断与成本分析 Agent 团队分享了一线 Harness 成本优化实战。团队先用自研探针、Langfuse 上报和自建评测 Agent,把 prompt token、缓存命中率与任务质量量化到同一度量上,再围绕 agent loop 切了六刀:精简 System Prompt 并改为每轮现场拼装、改造为 OpenAI 兼容请求字段、按需加载 deferred tools、把常驻工具 schema 对齐 Claude Code 定义、技能正文只注入一次并配合短回执、重复 Read 用 mtime 去重、把高频 MCP 能力迁回 CLI+Skills 以彻底砍掉 schema 开销。在缓存侧按 Constant/SessionStable/MidConversation/Dynamic 分层 system prompt 保持前缀稳定,并在 messages 尾部累计≥4096 字符处挂 cache_control,显式缓存加权命中约 0.898、中位 0.939。最终 20 轮会话输入侧费用从约 ¥9.84 降到 ¥1.16,降幅 88.2%,强调成本优化本质上是 Harness 工程而非外挂技巧。

来源:展开 1 条收起 1 条

DeepSeek上线多模态模型V4Flash Vision-Exp

DeepSeek 推出实验性多模态模型 deepseek-v4-flash-vision-exp,在 V4-Flash 文本能力基础上新增视觉理解能力,可处理图片输入并提升多模态 Agent 任务表现,多模态 Agent 基准测试接近 Opus-4.8 等高端模型。模型已上线 DeepSeek API 平台,DeepSeek Harness 0.1.1-rc.1 版本同步提供原生支持,支持混合文本与 Base64、外部 URL 或 Files API 图片输入,并兼容 Chat Completions、Messages 及 Responses API 调用。定价延续 V4-Flash,图片按尺寸换算为 token 计费,每张图最高 384 tokens,输入价格在 0.05 至 3 元/百万 tokens、输出在 4.5 至 9 元/百万 tokens 区间。同步上线 Files API,支持 JPEG/PNG/GIF/WebP,单文件最大 64 MiB、单用户 25 GiB、最多 1 万个文件,通过 file_id 跨请求复用图片,整体策略聚焦多模态 Agent 落地而非图像生成娱乐场景。

来源:展开 2 条收起 2 条

Multi-Agent工作流成本优化50%以上:腾讯技术团队实践

腾讯技术团队针对 1 个 TL + 6 个子 Agent 的 harness 工作流面临的 token 成本高企问题展开专项优化。先用 AgentLens 度量将成本归为系统提示词、工具返回、文件读取、长期记忆、历史消息、用户提示词六类,并归纳"让 AI 只看到当前需要的上下文、减少无关上下文、减少重复上下文"三条原则。在"只看到需要的"方向上,通过渐进式披露把 SKILL.md 正文缩 35%、用脚本替代确定性 MCP 操作、用专属子 Agent 获取 TAPD/Figma 数据并仅回传摘要使单轮 input token 降 38.4%、用 INDEX.md 索引按需加载长期记忆;在"减少无关"方向上,把单体 Agent 拆分为多 Agent 并给每个子 Agent 配置工具白名单和模型分层(测试/视觉改用 GLM-5v 降本 64%)、用代码图谱替代盲搜使总 token 降 22.7%;在"减少重复"方向上,通过稳定前缀设计提升 KV Cache 命中率、接入 rtk 压缩 CLI 输出 60%~90%、将无依赖的工具调用并行化。最终主 Agent 端到端 token 由 70.9 万降至 31.5 万(-55.5%),全流程中型需求 token 成本预计降 50%~65%

来源:展开 1 条收起 1 条

Azure DevOps Remote MCP Server 正式发布(GA)

MicrosoftAzure DevOps Remote MCP Server 正式发布为 GA,提供托管端点 https://mcp.dev.azure.com/{organization},基于可流式 HTTP 与 Microsoft Entra 认证,让 AI 助手无需本地安装即可访问工作项、拉取请求、仓库和管道。Claude Desktop、Claude Code、ChatGPT 和 Cursor 等第三方客户端目前无法连接,原因是 Entra 尚不支持动态 OAuth 客户端注册或 Client ID Metadata Documents;微软正与 Entra 团队推进该能力。在此期间,使用 Microsoft 第一方客户端(VS Code+Copilot、Microsoft Foundry、Copilot Studio、Visual Studio、GitHub Copilot CLI 和 GitHub Copilot 应用)的团队可零配置接入,非微软客户端的团队则需继续使用本地 MCP Server。此外,仅支持由 Entra 租户承载的组织,纯 Microsoft 账户的独立组织被永久排除。

来源:展开 1 条收起 1 条

Kakao董事会通过拆分方案,拟设立Kakao AI

韩国互联网巨头Kakao于8月21日宣布董事会通过公司拆分计划,拟将现有主体拆分为两家独立公司:新设的"Kakao AI"将聚焦KakaoTalk即时通讯及人工智能业务,定位为"AI核心公司";现有公司更名为"Kakao X",承担投资、金融科技、内容和出行业务。拆分按净资产账面价值以 36% 和 64% 的比例进行,现有股东按持股比例获得两家公司股份。Kakao计划将KakaoTalk升级为理解用户意图和对话上下文的智能代理式AI界面,通过AI Agent连接搜索、推荐、购物、支付等服务。时间表方面,公司拟于2026年12月17日召开临时股东大会,2027年1月1日完成拆分,随后于2027年1月27日推动Kakao AI重新上市并完成Kakao X上市变更,具体时间可能因监管协商而调整。

来源:展开 1 条收起 1 条

安全与风险

OpenAI因网络安全风险暂停部分强化学习训练并放缓前沿模型扩展

OpenAI 因前沿模型在网络安全能力上出现关键风险信号,近期放缓整体规模化节奏并暂停部分强化学习训练两周,其中规模最大的训练运行被暂搁。暂停期间,OpenAI 将重心转向小规模评估、安全系统强化与对齐研究,以建立更严格的模型发布与监测标准。事件导火索包括 Astra 模型被指可能越过网络安全能力阈值,以及开发过程中出现的安全事故和模型能力提升后的失配倾向。多家来源在措辞与时间细节上略有差异,但共同指向同一应对动作:在网络安全关键能力风险未化解前,主动收紧前沿模型训练与发布节奏。

影响: OpenAI前沿模型训练与发布节奏受限,Astra模型及大规模强化学习计划延期

建议: 在风险化解前避免将高网络安全能力模型部署到开放场景

来源:展开 3 条收起 3 条

私募股权巨头 Apollo 确认数据泄露,正值针对金融巨头的黑客攻击浪潮

美国知名私募股权公司 Apollo Global Management 确认发生数据泄露事件,黑客通过社会工程攻击于 7 月 6 日至 7 月 10 日入侵其云端环境,窃取了姓名、出生日期、联系信息、住址及社会安全号码等大量个人敏感数据。Apollo 人力资源负责人 Matthew Breitfelder 在提交给加州司法部长的信函中披露了此事,公司未说明具体受影响对象,也未回应是否支付赎金。Apollo 管理资产达 9380 亿美元,员工约 5000 人。该事件与 Google 安全研究员数周前警告的针对 Blackstone、Bridgewater、Bain Capital 等金融与私募巨头的勒索活动相关,攻击组织代号 Falcon、Helix、Pink、Redact,主要通过冒充帮助台诱导员工输入凭据,随后实施勒索,单笔赎金最高约 75 万美元

建议: 强化帮助台身份核验流程并对受影响个人提供信用监控

影响: Apollo约5000名员工及关联个人的姓名、出生日期、联系信息、住址及社会安全号码等敏感数据被窃

来源:展开 1 条收起 1 条

参议员就 TikTok 关闭安全功能的实验要求其作出答复

美国两位参议员 Marsha Blackburn(共和党,田纳西州)和 Richard Blumenthal(民主党,康涅狄格州)联名致信 TikTok,要求其就一项涉及约 1500 万美国用户的算法安全实验作出回应,信件抄送 TikTok 全球 CEO 周受权和美国业务 CEO Adam Presser。据彭博报道,TikTok 故意为 10% 的美国用户关闭了一项旨在防止有害内容过载的算法保护机制,以测试该机制对用户参与度的影响。其中一名对照组用户为 16 岁少年 Chase Nasca,其推荐算法持续推送大量关于悲伤、自杀和孤独的视频,直至其自杀身亡。参议员将此次实验形容为"堕落",并提出 13 个问题,包括参与知情人员名单、未成年人纳入对照组的原因,以及历史上所有曾关闭或延迟安全功能的算法实验清单,限期 TikTok 于 9 月 1 日前作出答复。TikTok 暂未回应置评请求。

建议: 立即恢复全部安全功能并公开实验范围与知情同意情况

影响: 约1500万美国用户(含未成年对照组用户)被纳入关闭算法安全保护机制的实验

来源:展开 1 条收起 1 条

日本云计算厂商樱花网络(Sakura Internet)遭黑客攻击 可能影响136万名客户

日本主要云计算与数据中心服务商 樱花网络(Sakura Internet) 发布安全公告,披露其客户管理系统在 2026 年 8 月 9 日遭到黑客入侵。初步调查显示,约 583 个账户出现未授权登录,黑客访问了面向客户的系统与客户数据,并在系统上安装恶意软件,樱花网络随后清理恶意软件并轮换所有可能泄露的凭证。后续调查估算受影响账户可能多达约 1,360,563 个,但官方表示目前尚未发生实际数据泄露。被窃取的数据为加盐哈希后的密码,破解难度较高,暂未引发账户登录风险。樱花网络强调此事件与勒索软件无关,没有黑客团体公开认领或索要赎金,公司亦未披露更多恶意软件细节。樱花网络同时是入选日本政府云计划的供应商,提供网站托管、VPS、公有云、数据中心及 GPU 计算等服务。

建议: 相关用户应尽快重置密码并启用多因素认证

影响: 樱花网络约1,360,563个客户账户存在被波及风险,初步确认约583个账户出现未授权登录

来源:展开 1 条收起 1 条

有人以虚假加密会议为诱饵定向攻击安全研究员

在 Black Hat 与 Def Con 黑客大会期间,一名冒充某知名加密货币新闻网站的人员通过 X 平台的公开回复和私信接触多名安全研究员,以一个并不存在的加密会议为诱饵,发送看似合法的 Google Doc 文档。文档侧栏借助 Google App Script 伪装成加密界面,要求目标输入黑客提供的虚假解密密钥,从而诱导其安装针对不同操作系统的恶意软件,包括 macOS 信息窃取程序、被改造的 Windows 远程桌面工具以及伪装成 Ledger 钱包的假安装包。安全公司 Huntress 研究员识破并假意配合以追踪攻击手法,相关账号未回应 TechCrunch 的询问。此事件再次显示即便是安全专业人员也会被定向攻击,攻击者利用合法 Google 服务提高了欺骗性。

建议: 对私信来源保持核验,勿在第三方文档中输入凭证或安装来源不明的应用

影响: Black Hat 与 Def Con 期间多名安全研究员面临被诱导安装 macOS 信息窃取程序、Windows 远程桌面改造工具或伪装 Ledger 钱包的风险

来源:展开 1 条收起 1 条

开源与工具

Spark-to-Paper:端到端论文生成系统,假结论检出率92%

Spark-to-Paper 是一套端到端研究论文生成系统,以 13 个可组合技能的形式运行在现有编程助手内部,无需独立部署智能体平台,从研究想法出发自动完成文献检索、实验设计、执行、写作、证据驱动修订与可编辑图生成,最终输出可直接编译的 LaTeX 项目。在 8 个受控课题上,其引文有效率达 99.5%,图形可编辑率 96.4%;对 36 条人为注入的假结论,检出率由单遍生成的 14% 提升至 92%,对抗式评审精确率 74%。系统采用预注册式实验设计、确定性 Gate、模型自省与最多 7 轮实验—批评—修订循环,并将失败轨迹保留为研究产出而不包装成成功论文。完整流程平均每篇消耗 11.9M token、成本 8.1 美元、耗时 3.2 小时,目前该论文已被 Hugging Face Papers 标记为当日第一,并已开源代码与资源。

适用场景: 研究自动化与AI辅助写作场景,适合需要生成可审阅、可复现的论文草稿

来源:展开 1 条收起 1 条

小红书开源发布大模型dots3-note preview

小红书在海外低调开源发布了大模型 dots3-note preview,采用 MoE 架构,总参数 280B、激活参数 16B,支持 512K 上下文,覆盖文本、视觉与语音多模态理解,属 dots3 系列中面向实际部署的效率版本,后续还将推出 jazz 与 aria。该系列曾在 IMO 2026 取得官方认证满分。新模型以 Apache 2.0 协议同步上线 Hugging Face 和 GitHub,海外开发者社区迅速讨论,华为昇腾当日宣布完成 0 Day 适配。小红书还开放了聚焦生活场景的 VibeSearchBench 和 VibeLifeBench 评测集。

适用场景: 内容平台、搜索推荐与生活服务场景下的多模态大模型底座选型

来源:展开 1 条收起 1 条

Google Gemma开源大模型全球下载量突破10亿次

Google DeepMind宣布其开源大模型Gemma系列全球下载量突破10亿次,过去两年开发者已发布超过10万个Gemma模型变体,形成"Gemmaverse"生态系统。Gemma已在多领域落地:NASA、Satlyt和Starcloud等团队在太空中部署该模型以支持星载图像分析和星际通信路由;印度国家卫生局将Gemma 4整合进下载量超1亿次的Aarogya Setu 2.0应用,用于医疗报告标准化和安全共享;耶鲁大学与Google基于Gemma构建C2S-Scale模型,发现并验证了一种新型癌症治疗途径;MedGemma模型在全印医学研究所和乌干达农村用于临床分诊;与佐治亚理工学院合作的DolphinGemma用于分析海豚发声。近期Kaggle Gemma挑战赛收到超1600个项目,Google还在GitHub推出"Awesome Gemma"资源库,以汇聚社区优秀项目和工具。

适用场景: 从太空、医疗到生物研究的开源模型落地参考与社区资源入口

来源:展开 1 条收起 1 条

Cloudflare 利用 AI Agent 将 Astro GitHub Issue 减少 85%

Cloudflare 为开源框架 Astro 部署了一套基于隔离 AI Agent 的 GitHub Actions 自动分诊流程,通过复现 Agent、诊断 Agent、验证 Agent 和修复 Agent 依次处理每个新 issue,并以 report.md 文件在各子 Agent 之间传递信息,由 GitHub issue 标签驱动的状态机协调流转。流程在识别出可行修复后生成预览版本供报告者验证,确认后自动开启 PR。Astro 的开放 issue 数量因此从 200 多降至约 30,下降约 85%,团队目标是清零。该工作流后被抽离为独立的 triagebot-action GitHub Action,其编排模型进一步演进为开源框架 Flue,支持声明式定义 Agent 上下文,通过仅追加事件日志实现可恢复的持久执行,并可在 Node.js、GitHub Actions 和 Cloudflare Durable Objects 上运行。

适用场景: 开源项目GitHub Issue自动化分诊与维护工作流搭建

来源:展开 1 条收起 1 条

OpenAI全面开源Codex Harness,AI编程智能体底层能力进一步开放

OpenAI进一步开源Codex Harness,将驱动Codex各产品形态的核心Agent运行环境向开发者开放。Codex Harness是Codex背后的Agent执行框架,涵盖Agent Loop、线程生命周期与持久化、配置认证、工具执行及扩展机制等模块,开发者可通过Codex App Server使用双向JSON-RPC协议将其接入不同客户端,获得实时事件流以构建IDE、桌面应用及定制化Agent产品。该框架已支撑Codex Web、CLI、IDE扩展和macOS应用等多种场景。OpenAI曾分享内部实践,约5个月形成约100万行代码、1500个PR,理念从人工写代码转向人类设目标、Agent执行。此次开源意味着AI编程竞争从模型层延伸至Agent运行时、工具调用与工程反馈闭环,开发者可在其上构建专业化编程与软件工程工作流。

适用场景: 需要自建IDE、桌面或定制化编程Agent产品的开发团队

来源:展开 1 条收起 1 条

数据与洞察

阿里巴巴发布新一季财报:阿里云AI收入与利润多项创新高

阿里巴巴于2026年8月20日发布2027财年第一季度财报,多项核心指标创近期新高。阿里云外部商业化收入同比增长45%,创近22个季度新高,经调整EBITA同比增长133%,利润率攀升至12%;AI相关产品收入已连续12个季度保持三位数同比增长,AI商业化全面加速。本季阿里云资本开支达677亿元,CEO吴泳铭在电话会上表示,按当前AI产品平均毛利水平,AI算力投入预计可在三年内回本,若毛利率提升,回报周期可能缩短至约两年半。在大消费板块,即时零售收入同比增长45%,淘宝闪购单位经济效益环比持续改善。但净利润同比暴跌75%,主因AI基础设施投入加大、运营成本上升及投资收益变化,本季度资本开支高达676.8亿元同比暴增75%。综合两份报道可见,AI与算力投入正成为驱动阿里本轮业绩增长的核心引擎。

意义: AI算力与商业化正成为阿里业绩核心引擎,但短期盈利能力受资本开支扩张压制

数据: 阿里云外部商业化收入同比增长45%创近22个季度新高,经调整EBITA同比增长133%、利润率12%;AI相关产品收入连续12个季度三位数同比增长;本季阿里云资本开支676.8至677亿元(同比暴增约75%),即时零售收入同比增长45%;集团净利润同比暴跌75%,营收2689.5亿元同比增长约9%,AI相关云服务及计算业务营收484.4亿元同比增长45%

来源:展开 3 条收起 3 条

测量语音识别中的基准优化现象

研究团队针对开源语音识别模型在公开基准上的"基准优化"现象(即模型倾向于复现基准参考文本而非忠实转写音频),设计了三种探测方法进行量化评估。测试覆盖 11 个主流开源 ASR 模型,结果显示 VoxPopuli 测试片段中约 40% 存在参考错误,涉及约 3% 的词;表现最好的模型在 18–30% 的情况下复现了错误参考。在参考不一致探测中,6 个模型未能转写音频中清晰可闻的"Thank you"。在掩码实体探测中,模型在被静音的数字位置仍以 30–40% 的概率输出参考中的数字。在正字法切换探测中,多个模型能根据数据集来源选择拼写风格,切换准确率最高达约 90%。团队认为问题源于模型识别出与基准相关的声学线索,并据此调整输出风格。

意义: 主流开源ASR存在系统性基准优化行为,公开基准的忠实度评估需引入更稳健的方法

数据: 测试覆盖11个主流开源ASR模型;VoxPopuli测试片段中约40%存在参考错误,涉及约3%的词;表现最好的模型在18%–30%的情况下复现了错误参考;6个模型未能转写音频中清晰可闻的"Thank you";静音数字位置仍以30%–40%概率输出参考数字;正字法切换准确率最高约90%

来源:展开 1 条收起 1 条

AI数据初创公司Micro1年化总营收运行率突破5亿美元

AI数据标注初创公司 Micro1 在过去八个月内将年化总营收运行率从 1 亿美元提升至 5 亿美元,净运行率约 1.5 亿至 2 亿美元,毛利率保持在 60%–70% 区间。公司通过聘请医生、律师、科学家等专家进行人工标注,并逐步引入自动化视频描述等合成数据生成能力,其通用数据集因可重复销售给多个客户,毛利率高达 80%–90%。Micro1 创始人 Ali Ansari 在 X 平台明确表示公司不出售数据给中国 AI 开发者,以区别于部分竞争对手。Micro1 起步于 AI 招聘业务,因客户利用其平台招募标注工程师而转型进入数据标注领域,业务还包括强化学习评估及家用机器人预训练数据集。2024 年 9 月 Micro1 以 5 亿美元估值完成 A 轮融资,据悉近期可能以更高估值完成新一轮融资,但公司未予置评。尽管规模仍落后于 Mercor(年化总营收 20 亿美元)和 Handshake(10 亿美元),Micro1 的增长表明 AI 训练数据市场需求足以支撑多家供应商。

意义: AI训练数据需求正快速膨胀,市场足以支撑多家供应商并可能比肩算力支出

数据: 过去8个月年化总营收运行率从1亿美元升至5亿美元,净运行率约1.5亿至2亿美元,毛利率60%–70%;通用/"现成"数据集毛利率80%–90%;2024年9月以5亿美元估值完成A轮融资;对比Mercor年化20亿美元、Handshake年化10亿美元

来源:展开 2 条收起 2 条

皮尤研究:ChatGPT发布后超三成网页出现AI创作痕迹

皮尤研究中心8月20日发布最新研究称,基于Common Crawl近5年约50万个英文网页并使用Open Pangram技术检测AI创作痕迹后发现,在2026年7月随机抽取的1万个网页中约10%存在明显AI创作痕迹;剔除ChatGPT发布前的旧网页后,2022年11月之后产生的网页中约35%存在AI创作痕迹。域名层面,.com网站AI痕迹比例约为.edu和.gov网站的10倍.org约为4.6%。研究还发现破折号、牛津逗号及"这不是X,而是Y"等AI特征表达持续增加。报告发布之际,Cloudflare也指出机器人网络流量已超过人类流量,互联网正呈现"AI生产、AI消费"的新特征。

意义: AI生成内容已大规模渗透公开网页,商业域名尤为明显,互联网内容结构正在重塑

数据: 基于Common Crawl近5年约50万个英文网页;2026年7月随机抽取的1万个网页中约10%存在明显AI创作痕迹;2022年11月ChatGPT发布后产生的网页中约35%存在AI创作痕迹;.com网站AI痕迹比例约为.edu和.gov网站的10倍,.org约为4.6%

来源:展开 1 条收起 1 条

新数据显示 OpenAI 正在企业用户市场追赶 Anthropic

企业支出管理平台 Ramp 发布新数据,显示 OpenAI 在美国企业用户市场正逐步缩小与 Anthropic 的差距。Anthropic 自今年5月以 41% 对 39% 反超 OpenAI 后持续领先,截至7月份额接近 44%,OpenAI 约为 40%。但 Ramp 经济学家 Ara Kharazian 指出,OpenAI 在本季度迄今的增长速度快于 Anthropic,分析师将这一变化归因于 OpenAI 新模型 GPT-5.6 Sol 在开发者中口碑上升,而 Anthropic 的高端模型 Fable 5 因价格及监管要求 30 天数据保留政策导致采用率不及预期。数据覆盖通过 Ramp 企业信用卡和账单支付产品消费超 70,000 家美国企业,且 AI 付费企业比例已从3月的 50% 升至7月的近 56%,表明两家公司在争夺份额的同时整体企业 AI 收入仍在增长,企业 AI 支出的粘性仍存在不确定性。

意义: Anthropic仍领先但OpenAI凭借新模型加速追赶,企业AI整体支出仍在扩张但粘性待观察

数据: Anthropic份额自5月以41%对39%反超OpenAI,截至7月升至约44%,OpenAI约40%;数据覆盖通过Ramp消费的70,000余家美国企业;AI付费企业比例从3月的50%升至7月的近56%

来源:展开 1 条收起 1 条

其他值得看

雷鸟创新(RayNeo)发布雷鸟iO AI眼镜

来源:展开 2 条收起 2 条

Starcloud融资2.5亿美元布局轨道数据中心

来源:展开 1 条收起 1 条

特斯拉、Uber和Waymo均获准在内华达运营数千辆机器人出租车

来源:展开 1 条收起 1 条

Meta向美国用户推出支持vibe-code与分享游戏的Pocket应用

来源:展开 1 条收起 1 条

Adobe Firefly音频工具全面上线,支持AI生成音乐、语音和音效

来源:展开 1 条收起 1 条

Google为出版商提供对抗AI引流下滑的新工具

来源:展开 1 条收起 1 条

Gemini 3.7 Flash在ARC-AGI-2达84.6%

来源:展开 1 条收起 1 条