内容
声明:完全使用AI生成,可能存在错误,需谨慎甄别。
摘要
2026-08-26 AI 领域呈现多线并进格局,值得关注的信息:苹果突袭发布 M6 与 M5 Ultra 两款自研芯片及新款 Mac mini、Mac Studio,主打本地 AI 算力;字节跳动正式发布 AI 办公智能体 豆包工作 并深度整合飞书;Arm 在 Hot Chips 2026 首次披露成立 36 年来首颗自研 AGI CPU;SpaceX 以约 600 亿美元完成对 Cursor 的收购,马斯克全员整合训话承认 Grok 落后;OpenAI 与 Broadcom 合作的自研推理芯片 Jalapeño 在 Hot Chips 公开演示,性能/功耗比宣称优于英伟达 Blackwell。
热点事件
苹果突袭发布M6与M5 Ultra芯片及新款Mac mini、Mac Studio
2026 年 8 月 25 日,苹果未举办发布会直接上架 M6 与 M5 Ultra 两款自研芯片及 2026 款 Mac mini、Mac Studio,两款新品均于 8 月 27 日在中国大陆开启预购,9 月 22 日正式发售。M6 采用台积电 2 纳米制程,配备 12 核 CPU 与 12 核 GPU,集成双 16 核神经网络引擎,苹果称其单线程性能全球最快;M5 Ultra 则采用四晶粒架构,最高提供 36 核 CPU 与 80 核 GPU,可支持 512GB 统一内存,AI 峰值算力较 M3 Ultra 提升约 4.3 至 4.5 倍。Mac mini 国行起售价 6999 元,Mac Studio 起售价 19999 元,整体定价较上代上调约 100 至 200 美元。两款设备均主打本地 AI 能力,可本地推理与微调大模型,统一内存带宽最高达 12,000GB/秒,并支持 Wi-Fi 7 与蓝牙 6。
重点: 苹果首次以 2 纳米制程 M6 和怪兽级 M5 Ultra 抢攻端侧大模型推理。
来源:展开 6 条收起 6 条
- 苹果突袭发布M6与M5 Ultra芯片及新款Mac mini、Mac Studio(极客公园)
- 苹果发布M6 Mac mini与M5 Ultra Mac Studio(爱范儿)
- 苹果发布基于2纳米制程的M6芯片 同时发布M5 Ultra芯片 最高80颗GPU核心(蓝点网)
- 苹果正式推出 M6 芯片:12 核 CPU,单线程性能全球领先(Readhub - 每日早报)
- 苹果推出搭载 M5 Max 和 M5 Ultra 芯片的新款 Mac Studio(Readhub - 每日早报)
- 本地硬刚数千亿参数大模型!苹果新Mac全线堆料升级,M6芯片与怪兽级M5 Ultra震撼登场(AI新闻资讯)
字节跳动发布AI办公智能体豆包工作 深度整合飞书
2026 年 8 月 25 日,字节跳动正式发布面向生产力场景的 AI Agent 产品「豆包工作」,这是其将 TRAE、扣子团队并入豆包体系后推出的统一办公品牌。该产品可围绕用户目标自主拆解任务、调用工具,支持文档、表格、PPT、图片、视频、网页及应用生成编辑,并通过虚拟桌面操控浏览器与本地电脑跨软件完成任务。其核心卖点在于与飞书深度打通,授权后能调用群聊、文档、会议纪要、多维表格等企业私有上下文,落地周报生成、客户需求提炼、经销政策梳理与销售目标拆解等场景,同时依托飞书企业级安全合规底座构建防护。电脑版即日起开放下载,官方同步推出 30 天免费订阅权益,业内认为此举有望加速智能 Agent 在企业业务中的规模化落地。
重点: 豆包工作打通飞书企业上下文,标志办公 Agent 进入组织内流。
来源:展开 5 条收起 5 条
- 字节跳动发布AI办公Agent豆包工作(极客公园)
- 字节发布豆包工作Agent产品(极客公园)
- 字节跳动发布AI办公智能体“豆包工作”,打通飞书生态重构企业生产力(AI新闻资讯)
- 深度实测「豆包工作」+飞书:目前最接近企业Agent终局的答案(量子位)
- 字节正式发布 AI 办公产品「豆包工作」(Readhub - 每日早报)
Arm成立36年来首颗自研AGI CPU亮相Hot Chips 2026
在 Hot Chips 2026 大会上,Arm 首次披露成立 36 年来首颗自研量产芯片——AGI CPU,标志着其从 IP 授权向芯片制造延伸。该处理器基于第三代 Neoverse V3 核心与 Armv9.2 架构,单颗最多集成 136 个核心、最高频率 3.7GHz,采用台积电 3nm N3P 工艺与双芯粒设计,完整芯片拥有约 1000 亿个晶体管、最大 TDP 300W。I/O 方面提供 96 条 PCIe Gen6 通道,支持 CXL 3.0 与 DDR5-8800 内存,单颗内存容量达 6TB,内存延迟低于 100ns。该芯片面向智能体 AI 负载,是 Arm 争夺 AI 算力市场、向产业链上游延伸的关键里程碑。
重点: Arm 36 年来首次造芯,自研 AGI CPU 加码智能体 AI 算力。
来源:展开 2 条收起 2 条
- Arm 成立 36 年来首颗自研芯片:台积电 3nm 工艺(Readhub - 每日早报)
- Arm成立36年来首颗自研芯片采用台积电3nm工艺(极客公园)
SpaceX六百亿美元收购Cursor 马斯克全员整合训话
多家报道指向同一事件:SpaceX 以约 600 亿美元完成对 Cursor 的收购,交易当天马斯克召开 Cursor 全员视频会议启动深度整合。马斯克在会上首次承认 SpaceX AI 部门落后于 Anthropic 等对手,直言 Grok 并非市场领导者,要求团队全力攻坚核心技术,并强调将继续大规模囤积算力,同时警示 AI 终将发展到人类难以掌控的阶段。整合过程中 Cursor 经历明显动荡,多名高层及 Graphite 团队核心成员离职,股权兑现与薪酬方案被调整,最终 Cursor 高管团队正式进入 SpaceX AI 任职,双方围绕 Origin 等项目推进团队与算力资源全面融合。
重点: 600 亿美元天价收购背后,马斯克罕见承认 Grok 落后。
来源:展开 2 条收起 2 条
- 马斯克承认Grok在AI竞赛中落后(极客公园)
- 马斯克训话曝光:斥资600亿收购Cursor后开启深度整合(AI新闻资讯)
OpenAI首款自研推理芯片Jalapeño 强于英伟达Blackwell
OpenAI 在 Hot Chips 大会上首次演示其自研推理芯片 Jalapeño,该芯片与 Broadcom 合作研发,设计工作始于 2024 年,从团队组建到完成流片仅用约 16 个月。Jalapeño 并非专为 OpenAI 内部模型推理设计,而是定位为通用推理芯片。性能测试显示,几乎所有场景下 Jalapeño 的性能/功耗比均优于英伟达 Blackwell,原因在于当前 AI 公司普遍受限于电力供应,新增电力比扩建数据中心更耗时且成本更高。英伟达在 Hot Chips 介绍新一代芯片 Vera 时也强调了供电问题对营收的直接影响。
重点: OpenAI 联手 Broadcom 自研推理芯片,性能/功耗比挑战 Blackwell。
来源:展开 1 条收起 1 条
- OpenAI 首款自研推理芯片 Jalapeño 强于英伟达 Blackwell(奇客Solidot–传递最新科技情报)
变更与实践
Anthropic打通Claude聊天与Cowork共享记忆 全端默认上线
Anthropic 于 2026 年 8 月 25 日宣布对 Claude 记忆系统进行重大升级,正式打通 Claude 聊天与 Claude Cowork 之间的记忆屏障,实现双向互通与跨平台上下文共享。此前用户在两端切换时常需反复交代项目背景,更新后聊天中累积的记忆可供 Cowork 在云端执行任务时直接调用,Cowork 产生的新记忆也能回到聊天中复用。功能覆盖网页、桌面及 iOS、Android 移动端,面向 Free、Pro、Max 套餐用户默认开启,Team 与 Enterprise 计划由管理员控制。隐私方面,健康、种族、宗教、政治、性别认同等敏感话题默认不存入记忆,用户可在设置中手动开启,开启后每次写入均会收到通知,且仅对未来内容生效;身份证号、犯罪记录、移民状态等始终不会被保存。用户还可逐条查看、编辑或删除记忆记录,将长期记忆的控制权交还个人。
来源:展开 6 条收起 6 条
- Claude 的记忆功能全场景生效,存储内容由你决定(Claude Blog)
- Claude 记忆打通 Cowork 与聊天:背景一次说明,两端共享(AI新闻资讯)
- Claude重磅升级:Cowork与日常聊天实现数据互通(AI新闻资讯)
- Anthropic打通Claude与Cowork记忆系统 消除跨工作流重复交互痛点(AI新闻资讯)
- Anthropic打通Claude Cowork与聊天的记忆功能(极客公园)
- 谷歌杀入法律 AI:Gemini Enterprise 推出专用法律工具,剑指律所赛道(AI新闻资讯)
离开剪映后创业,她想把一支设计团队装进AI工作台
前剪映中国负责人张琪智离职字节跳动后创办 AI 工作台 OJO,定位 Design Agent Team Workspace,已完成近亿元首轮融资,由顺为资本与联想创投联合投资,高鹄资本担任独家财务顾问。张琪智 2017 年加入脸萌,2018 年随团队并入字节,长期参与剪映与海外版 CapCut 的产品与全球化业务。她认为当 coding agent 降低产品构建门槛后,设计判断在产品、设计与开发之间的连续传递成为新的断点。OJO 不采用单一 Agent 走完流程的形态,而是把任务拆成可组合的 Agent Team 与 Skills,通过主 Agent 调度,将产品定义、视觉设计、交互迭代与代码交付组织进一条连续流程,并以乔布斯、梵高、达芬奇等角色包装 Agent 降低理解门槛。当前 OJO 已优先在海外开放使用,瞄准的并非专业设计师,而是产品经理、市场人员、创业者等有强烈设计需求但缺少完整团队的角色。
来源:展开 1 条收起 1 条
谷歌扩展Gemini Enterprise推出法律专用工具
Alphabet 旗下谷歌于周二宣布扩展 Gemini Enterprise 平台,正式推出面向律师事务所和法律从业者的专用工具 Gemini Enterprise for Legal。该平台内置可独立处理专业法律及行政工作的 AI 智能体,支持多种法律软件插件,允许用户在不同 AI 模型间自由切换,并在数据安全与保密性方面提供严格保障。研发阶段谷歌已与 Weil Gotshal、Cleary Gottlieb、Freshfields 及 Williams & Connolly 等知名律所展开战略合作。法律科技赛道竞争加剧,Anthropic、汤森路透(基于权威法律内容训练的 Thomson 1.0 大模型)以及 Harvey、Legora 等专业法律 AI 厂商均在加速布局。
来源:展开 2 条收起 2 条
OpenAI推出ChatGPT Work与Codex管理插件
OpenAI 推出面向 ChatGPT Work 与 Codex 的 Admin 插件,使管理员可在一次对话中查询工作区活动、积分消耗、成员与群组、权限、额度和支出请求,并在授权后执行相应管理操作。插件沿用用户既有角色、权限、工作区策略及审批要求,不会扩大访问范围,还可将待处理请求发送至 Slack 或 Microsoft Teams,并按预设条件自动处理常规任务。OpenAI 称,其 IT 团队借助该插件提升管理效率,相关工作流约处理了 45% 的工单量,并通过运营健康看板清理积压、改善服务规划。
来源:展开 1 条收起 1 条
- OpenAI 推出 ChatGPT Work 与 Codex 管理插件(OpenAI News)
Stability AI完成7600万美元B轮 三大唱片与EA联手押注
Stability AI 于 8 月 25 日宣布完成7600 万美元 B 轮融资,投资方阵容横跨音乐与游戏两大内容产业,环球音乐、索尼音乐、华纳音乐三大唱片集团与游戏巨头 EA 联袂参投,AMD Ventures 及 Pacific Alliance Ventures 亦参与跟投,公司累计融资额达 2.32 亿美元。CEO Prem Akkaraju 表示,新资金将用于完善面向音乐、视频与图像生成的创意制作产品套件,深化应用研究并拓展专业服务业务。本轮融资延续了 Stability AI 自 2025 年 10 月起与环球音乐及 EA、11 月与华纳音乐在生成式 AI 嵌入核心创意工作流程方面的战略合作,折射出 AI 公司与内容版权方正从对抗走向共生的产业趋势。与此同时,公司与 Getty Images 的训练数据侵权诉讼中,英国诉讼已基本胜诉,美国诉讼仍在审理中。
来源:展开 2 条收起 2 条
安全与风险
Meta就29州起诉其社交媒体危害儿童一案达成180亿美元和解
Meta 已同意向 29 个美国州支付最高 180 亿美元,以和解有关其社交平台对青少年造成伤害的诉讼。各州指控 Meta 明知故犯地设计 Instagram 和 Facebook 等平台,使儿童上瘾,并了解这些产品可能对年轻用户造成伤害;此外还被指控在未经家长同意的情况下收集儿童数据,违反《儿童在线隐私保护法》(COPPA)。通过此次和解,Meta 并不承认相关指控有罪,但反映出其不愿继续进行陪审团审判。Meta 在官方博客中将此次和解定位为面向整个行业的行动倡议,呼吁 YouTube 和 TikTok 等平台也跟进采用针对青少年的保护措施和家长控制功能,并表示已与各州总检察长合作,试图建立新的行业标准。
影响: 受影响对象为 Instagram 与 Facebook 上的青少年用户及其家庭,以及行业层面的其他社交平台。
建议: 建议家长与平台同步启用青少年保护与家长控制,平台配合监管推进行业标准落地。
来源:展开 1 条收起 1 条
- Meta 就 29 州起诉其社交媒体危害儿童一案达成 180 亿美元和解(TechCrunch)
CISA确认7月份黑客攻击了超过100个美国水务系统
美国网络安全与基础设施安全局(CISA)确认,在针对美国关键基础设施的黑客攻击浪潮中,已有超过 100 个面向互联网的水务与污水处理系统遭到攻击。攻击主要瞄准多家厂商生产的可编程逻辑控制器(PLC),包括罗克韦尔、施耐德电气和西门子。CISA 此前曾表示,部分攻击利用 AI 工具基于公开信息开发脚本,攻击存在漏洞的西门子 PLC。一些入侵事件使黑客能够修改 PLC,禁用停机流程和警报,可能在不通知操作员的情况下制造不安全条件,但尚未对当地供水造成重大影响。受影响社区多位于农村或偏远地区。美国情报机构认为伊朗可能是攻击的幕后推手,作为对美国和以色列对伊战争的回应,但尚未做出明确归因。
影响: 受影响对象为美国 100 余个农村及偏远地区水务与污水处理系统的运营商和当地居民。
建议: 建议相关水务运营方立即隔离暴露 PLC、修补已知漏洞并按 CISA 指引开展风险评估。
来源:展开 1 条收起 1 条
- CISA确认7月份黑客攻击了超过100个美国水务系统(TechCrunch)
X向开源项目Nitter发出停止侵权函 指控其抓取数据
X 公司于 2026 年 8 月 24 日向开源项目 Nitter 发出停止侵权函,要求永久下架 Nitter 实例及代码仓库,指控其非法抓取 X 数据、绕过 API 并访问账号与会话令牌,违反德州计算机访问法及兰哈姆法等州和联邦法律,限其于 8 月 25 日美东时间下午 5 点前关停。Nitter 通过抓取公开帖子并剥离广告、追踪脚本,为用户提供无需登录的阅读体验,还支撑了 XCancel 等第三方站点。此次是 X 在 2024 年通过 API 限制迫使 Nitter.net 短暂下线后的第二次打击,开发者 Zedeus 已暂停开发并寻求法律意见。Nitter 过去七年为潜水党提供便利的渠道如今面临终结,用户将被导回需登录的官方应用。Meta 等平台同样在打击第三方抓取工具。
影响: 受影响对象为 Nitter 与 XCancel 等第三方抓取工具的用户、运营者及开源社区。
建议: 建议依赖第三方镜像的研究者与用户迁移至官方客户端或自行评估合规边界。
来源:展开 3 条收起 3 条
- X 向开源项目 Nitter 发出停止侵权函,指控其抓取数据(TechCrunch)
- 悲报:开源项目Nitter收到X法律通知函 目前该项目已下线 开发者正在寻求法律咨询(蓝点网)
- X Corp 发函要求停止侵权,推文镜像站 XCancel 宣布关停(Andrej Karpathy Curated RSS)
用过就要说:加州律考AI出题立法 人审不豁免
2025 年 2 月加州律考因 State Bar 裁撤 NCBE 多选题合同、改由 Kaplan 出题而爆发系统崩溃与公信力危机。事后披露的 171 道计分题中,23 道由心理测量商 ACS Ventures 用 AI 直接生成且未事先报告,违反与 Kaplan 合同中生成式 AI 参与度须保持最低限度的约定。加州参议院司法委员会将其定性为彻底的灾难,随后 State Bar 安排 85 名受影响考生补考、复查改判 8 人合格、加州最高法院裁定 7 月考试全面回归线下并恢复 NCBE 题库,考生针对 Meazure 的集体诉讼于 2026 年 8 月和解。危机推动众议员 Diane Dixon 提出 AB 1651 法案,由州长于 2026 年 8 月 22 日签署、编入加州 2026 年法规汇编 Chapter 116,新增《商业与职业法典》§6060.15,自 2028 年 1 月 1 日起施行。法案确立披露义务不因人类审核而豁免的核心规则,构成资格认证考试领域首个法定 T4 人审不豁免披露制度。
影响: 受影响对象为加州律考考生、官方备考材料使用者及相关法律职业认证体系。
建议: 建议律协、考试机构与备考服务商提前 60 天公示 AI 涉题范围并完善人审留痕。
来源:展开 1 条收起 1 条
- 用过就要说:加州律考 AI 出题立法,人审不豁免(Deep News — Superlinear Academy)
新西兰提出法案禁止16岁以下儿童使用社媒和AI陪伴服务
新西兰政府提出《在线安全(最低年龄与儿童安全风险评估)法案》,拟禁止 16 岁以下未成年人使用社交媒体和 AI 陪伴服务。总理 Christopher Luxon 表示,现实世界已有保护儿童的措施,虚拟世界也应建立同等保护机制。法案要求社媒平台对含有推荐系统、无限信息流、反馈功能和限时功能等对儿童有害的功能设置年龄限制,并限制未成年用户访问 AI 陪伴服务;即时通讯、职业社交、游戏、音乐及教育和健康工具不受限制。平台需通过面部扫描和用户活动模式验证年龄,并对 18 岁以下用户开展儿童安全风险评估,防范欺凌、暴力和色情内容侵害。
影响: 受影响对象为 16 岁以下未成年人、社媒与 AI 陪伴平台及其在澳新市场的运营合规体系。
建议: 建议相关平台尽早完成年龄核验、限流与儿童安全风险评估等合规改造。
来源:展开 1 条收起 1 条
- 新西兰提出法案禁止 16 岁以下儿童使用社媒和 AI 陪伴服务(奇客Solidot–传递最新科技情报)
开源与工具
Z.ai确认并发布Ox Alpha(GLM新模型权重)
据彭博社报道,神秘开源权重 AI 模型 Ox Alpha 由中国 AI 实验室 Z.ai 开发,属其 GLM 系列的最新迭代版本。Z.ai 确认 Ox Alpha 是一款面向编程、长周期智能体任务和生产工作负载的推理模型,支持长周期软件工程、复杂推理及文本与视觉上下文结合的工作流,并计划于周三发布模型权重,供开发者在其上构建应用。此前,Hugging Face 近日使用 Z.ai 的 GLM 系列模型抵御了来自 OpenAI 智能体的攻击。本月早些时候,Z.ai 还发布了 GLM-5.3,在部分基准测试中可与 Anthropic 的 Fable 5 相媲美。Ox Alpha 的发布进一步加剧了中国低成本、高能力模型对 OpenAI、Anthropic 等前沿模型公司市场份额的潜在威胁。
适用场景: 适合编程、长周期软件工程、复杂推理与多模态 Agent 等生产级负载的自托管场景。
来源:展开 2 条收起 2 条
- 出人意料:神秘 Ox Alpha 模型背后的 AI 实验室是 Z.ai(TechCrunch)
- 🤨 Z.ai 确认 Ox Alpha 是 GLM 新模型并将发布权重(News Hacker | 极客洞察)
Granite 4.2大语言模型:构建方式解析
IBM Granite 团队发布 Granite 4.2 推理大模型系列,包含 3B、8B 和 30B 三种规模的纯解码器密集 Transformer 模型,全部采用 Apache 2.0 协议开源。模型从零开始在约 15T tokens 上以五阶段策略预训练,将上下文窗口扩展至 512K,再经过约 720 万样本的 SFT(含 agentic 与非 agentic 数据),并接入多阶段多环境强化学习流水线 RLVR→技能 booster→SWE→Terminal→Search→RLHF,其中 8B 与 30B 额外学习在真实沙箱中使用工具的 agentic RL。模型支持思考/非思考切换、低思考预算和原生工具调用,兼容 vLLM 和 SGLang 的 OpenAI 格式接口。30B 在 SWE-Bench Verified 上达到 57.00、AIME25 达 89.17;同步提供 FP8、NVFP4、MXFP4 和多种 GGUF 量化版本。
适用场景: 适合需要 512K 长上下文、原生工具调用与 Apache 2.0 自托管的企业 Agent 与代码任务。
来源:展开 1 条收起 1 条
- Granite 4.2 大语言模型:构建方式解析(Hugging Face - Blog)
browser-use:让AI像人一样使用浏览器的开源自动化框架
browser-use 是一个开源 AI 浏览器自动化项目,允许 AI agent 像人类一样操作网页,完成填写表单、抓取数据等任务。项目提供 CLI 和 Python 库两种使用方式:CLI 适合配合 Claude Code、Cursor 等已有 agent 使用,Python 库则适合在自有代码中集成以实现定时、并行或嵌入产品。此外还有 Browser Use Cloud 托管服务,主打更强的代理能力、反指纹、代理轮换和 CAPTCHA 求解。模型方面推荐自家优化的 ChatBrowserUse,在浏览器任务上比其他模型快 3 到 5 倍,同时支持通过统一 API KEY 调用 Claude、GPT、Gemini。项目在 Odysseys 排行榜上以 87.4% 平均得分位居第一,开源库基于 MIT 协议,由位于苏黎世和旧金山的团队开发。
适用场景: 适合为已有 Agent 嵌入浏览器操作能力,或构建可定时、并行执行的网页自动化工作流。
来源:展开 1 条收起 1 条
- browser-use/browser-use:让 AI 像人一样使用浏览器的开源自动化框架(Trending repositories on GitHub today · GitHub)
Diagrid Catalyst 2.0为AI Agent加入持久化与可验证执行能力
Diagrid 于 2026 年 7 月 28 日发布 Catalyst 2.0,为基于 LangGraph、Microsoft Agent Framework、Google ADK、Dapr Agents 等十大框架构建的 AI Agent 引入持久化执行与加密验证能力。Catalyst 将模型与工具调用建模为持久工作流活动,支持中断后断点续跑,避免重复已完成步骤;验证机制源自 Dapr 1.18,通过对工作流历史事件批次进行哈希链式签名并以 SPIFFE 身份签署,可在历史被删除、重排或篡改时检测异常,外部接收方可独立校验。产品支持云、本地和离线环境,提供 Python SDK 与多语言工作流 SDK;ZEISS 被列为早期客户。
适用场景: 适合对执行可追溯、可审计有强需求的金融、制造与合规场景的 Agent 编排与运行。
来源:展开 1 条收起 1 条
前Meta科学家希望将视觉AI引入工厂车间
前 Meta 研究科学家 Armen Aghajanyan 与 Akshat Shrivastava 于 2024 年 11 月创立 Perceptron,专注开发面向工业场景的前沿视觉模型。本周公司发布最新模型 Isaac 0.5,旨在让机器人在仓库和工厂等复杂物理环境中实现感知、推理与行动,并可从机器人拍摄的视频中提取视觉信息。该模型以开源权重形式发布,允许任何人查看参数和训练数据。Perceptron 近期完成 2100 万美元融资,由 Bessemer Venture Partners 领投。公司强调 Isaac 0.5 是通用型模型,可在制造、物流仓储、安防、出行以及媒体娱乐等多种场景中灵活部署。训练数据包括一百万小时通用视频、自拍视角视频以及 UMI 动作视频,由公司自建的跨模态 PB 级数据集支持。
适用场景: 适合制造、物流仓储与安防等需要通用视觉感知与机器人决策的工业部署场景。
来源:展开 1 条收起 1 条
- 前Meta科学家希望将视觉AI引入工厂车间(TechCrunch)
数据与洞察
Agentic AI的第三种范式来了,16家机构提出伴身智能体
Mila、蒙特利尔大学、A*STAR、牛津、剑桥、清华等 16 家机构的 22 位研究者联合发布论文《ComBodied Agents: a New Paradigm of Human-Centric Agentic AI》,提出伴身智能体新范式,呼吁 Agent 优化对象从外部任务状态扩展到人的长期状态轨迹与主体性。论文以行动基底区分数字智能体、具身智能体与伴身智能体,并给出由人类状态感知、纵向记忆、个人世界模型与干预规划构成的闭环技术框架,强调观察、事件、推断、预测、获准干预的链路不可跳步。个人世界模型被界定为目的有界的预测工具而非数字孪生,部署被划分为云端中心、边云协同与边缘原生三阶段,主张将隐私泄露、操纵和有害依赖等列为不可补偿的关键失败。
数据: 16 家机构、22 位研究者参与;提出个人世界模型与三阶段部署框架;建立 8 组 agency preservation 维度。
意义: 将 Agent 优化目标从外部任务拉回人的长期状态与主体性,提示 AI 不应以参与度替代福祉。
来源:展开 1 条收起 1 条
斯坦福研究:22至25岁职场新人受AI冲击最大,高等教育成缓冲阀
斯坦福数字经济实验室 8 月 12 日更新论文,依托薪资服务商 ADP 覆盖数百万美国劳动者的高频数据,分析生成式 AI 普及后劳动力市场的变化。研究发现,AI 冲击集中于 22 至 25 岁职场新人,而非引发全美大规模岗位替代:在软件开发、客服等高 AI 影响职业中,该年龄段入门就业率比受影响较小领域落后约 19%,较 2025 年的 13% 差距进一步扩大;同一岗位资深从业者就业保持平稳甚至上升,呈现代际分化。原因在于入门岗依赖可编码化知识,易被 AI 替代;而依赖默会知识的岗位中,AI 更可能辅助资深员工。此外,高等教育能缓冲 AI 冲击,越易自动化的职业入门就业率下滑越明显。
数据: 高 AI 影响职业入门就业率落后 19%;较 2025 年的 13% 差距扩大;数据源自数百万 ADP 劳动者样本。
意义: AI 冲击呈现代际分化,提示高等教育与职业选择应聚焦难以编码的默会能力。
来源:展开 1 条收起 1 条
Falcon TST 2.0获世界权威测评第一名 推动时间序列基础模型从通用预测走向金融应用
蚂蚁国际发布自研时序 AI 预测大模型鹰序 TST(Falcon TST)2.0 版,在 GIFT-Eval 等全球权威基准测试中以平均绝对比例误差(MASE)0.666 取得最优成绩,预测准确率稳定超过 93%。该模型专为跨境支付外汇风险管理设计,已被巴克莱、花旗、德意志、渣打等银行应用于现金流预测与外汇敞口管理。2025 年以来蚂蚁国际先后与 Barclays、Citi、Standard Chartered 及 Capital A 达成合作;其中 AirAsia 披露对冲成本最高下降 40%,渣打披露外汇成本最高下降 60%。2026 年又以 Falcon-2.0 强化单变量 Encoder-Only 预测并开放 API,以 Falcon-X 补足异构多变量关系建模,论文报告 GIFT-Eval MASE 0.687。
数据: GIFT-Eval MASE 0.666、预测准确率超 93%;AirAsia 对冲成本最高降 40%、渣打外汇成本最高降 60%。
意义: 金融 TSFM 竞争重点将从榜单转向真实风险流程的稳定性、分位数校准与工程落地能力。
来源:展开 1 条收起 1 条
论文揭示大模型评测夹具变量风险
研究团队对三千余道评测题目进行配置重测,发现评测夹具中的微小变量可显著拉开模型分数,脆弱题目贡献了榜单 95.7% 的总分差。结果呼吁社区关注评测标准化的工程细节,避免高敏感性配置导致榜单排名失真,对大模型选型与基准建设具有方法论意义。
数据: 3000 余道评测题被重测,脆弱题目贡献榜单 95.7% 的总分差。
意义: 提示大模型榜单对配置极度敏感,基准建设需将工程变量纳入标准化治理。
来源:展开 1 条收起 1 条
- 论文揭示大模型评测夹具变量风险(AI洞察日报 RSS Feed)
SparseRead长程阅读省令牌
SparseRead 论文提出在上下文窗口前增加证据筛选层,先定位关键证据再输入主模型,在六款模型上将令牌消耗最高降低 92.9%。方法在保持任务质量基本不变的前提下显著压缩长文档处理成本,适合法律、研究综述等需要海量上下文的 Agent 场景。
数据: 在 6 款模型上令牌消耗最高降低 92.9%,任务质量基本保持不变。
意义: 为长上下文 Agent 提供低成本前筛范式,可显著压缩法律、研究综述等场景的运行成本。
来源:展开 1 条收起 1 条
- SparseRead长程阅读省令牌(AI洞察日报 RSS Feed)
其他值得看
Anthropic披露IPO招股书 估值2万亿募资千亿 画30万亿TAM蓝图
来源:展开 3 条收起 3 条
Shopify CEO考虑禁用Claude Code 因其不兼容AGENTS.md
来源:展开 2 条收起 2 条
硅谷今日最热具身模型!不用后训练 看一遍就学会
来源:展开 1 条收起 1 条
中国AI出海杀入巨头腹地 月之暗面携Kimi K3洽谈美云巨头30%分成
来源:展开 2 条收起 2 条
- 中国AI出海杀入巨头腹地,月之暗面携Kimi K3洽谈美云巨头30%分成(AI新闻资讯)
- 月之暗面与微软、亚马逊和 Google 协商收益分成协议(奇客Solidot–传递最新科技情报)
Anthropic因外包安保人员或罢工通知旧金山员工居家办公
来源:展开 2 条收起 2 条
- Anthropic 要求旧金山员工居家办公,因安保人员可能罢工(Readhub - 每日早报)
- 因保安可能罢工 Anthropic 通知员工远程办公(奇客Solidot–传递最新科技情报)
OpenAI再失一名数据中心高管 高知名度离职潮持续
来源:展开 1 条收起 1 条
- OpenAI再失一名数据中心高管,高知名度离职潮持续(TechCrunch)
突破遥操瓶颈!全新无本体数据世界动作模型Noe-0发布
来源:展开 1 条收起 1 条
DeepSeek前7月营收4.75亿元激增9倍 5000亿估值二轮融资在途
来源:展开 1 条收起 1 条
Bill Gates发表AI未来悲观长文 提议机器人税与人类保留岗位
来源:展开 2 条收起 2 条
- 比尔·盖茨提议征收"机器人税"并设立"人类保留"岗位以应对 AI 危害(TechCrunch)
- 盖茨发文表达对AI前景的悲观判断(Spyglass)