内容
声明:完全使用AI生成,可能存在错误,需谨慎甄别。
摘要
2026-08-17 AI 领域呈现多线并进格局,值得关注的信息:DeepSeek API 峰谷定价正式生效,V4-Pro 缓存命中价最高涨幅约 12 倍,标志其告别极致性价比;Stripe 以超 70 亿美元收购 AI 模型聚合平台 OpenRouter,估值较五个月前涨超五倍,整合模型路由与支付生态;OpenAI 加入英伟达与 SB Energy 的俄亥俄州 PORTS-Pike 数据中心项目,锁定约 8 吉瓦 IT 容量,首期信贷担保从约 2500 亿降至不足 1200 亿美元;支付宝发布全栈智能体商业底座与 AHA 跨端互联协议,联合 20 余家企业共建生态;智谱开源 GLM-5.3,编程与网络安全能力大幅提升,并开放网安权限申请。
热点事件
DeepSeek API 峰谷定价正式生效
深度求索自 2026 年 8 月 17 日零时起对 DeepSeek API 启用峰谷分时计价方案,高峰时段为每日 9:00–12:00 及 14:00–18:00,闲时价格为高峰的一半,覆盖 DeepSeek-V4-Flash 与 V4-Pro 两款主力模型,V4-Pro 同步转商用并支持最长 384K 上下文。以 V4-Pro 为例,百万 tokens 缓存命中输入价由 0.025 元涨至闲时 0.15 元、高峰 0.30 元,最高涨幅约 12 倍(1100%),输出价由 6 元涨至 13.5 元和 27 元;V4-Flash 各档涨幅约 50%–400%。官方表示,此举旨在通过市场化价格杠杆引导开发者错峰调用、缓解高峰算力拥堵,标志着 DeepSeek 从极致性价比策略转向精细化运营,但部分用户已开始迁移至其他平台或回归本地推理。
重点: V4-Pro 最高涨幅达 12 倍,标志 DeepSeek 告别极致性价比。
来源:展开 5 条收起 5 条
- DeepSeek启用峰谷定价,V4-Pro支持384K上下文(AI洞察日报 RSS Feed)
- 闲时半价、高峰翻倍:DeepSeek API峰谷定价上线,V4Pro最高涨11倍(AI新闻资讯)
- DeepSeek 调价方案公布 8 月 17 日生效(Readhub - 每日早报)
- DeepSeek API 峰谷定价今日生效,高峰时段价格翻倍(极客公园)
- DeepSeek API定价大幅上调V4-Pro缓存命中涨幅最高1114%(AI 开发者日报)
OpenAI 加入 PORTS-Pike 俄亥俄州数据中心项目
英伟达披露 OpenAI 将加入位于俄亥俄州派克县的 PORTS-Pike 数据中心项目,与 SB Energy、美国能源部合作,锁定约 8 吉瓦 IT 容量。园区建在原朴茨茅斯气体扩散厂旧址,由 SB Energy 以 20 年租约建设并持有运营,独家搭载英伟达 AI 基础设施。OpenAI 在 SB Energy 已承诺的 4000 万美元社区基金基础上追加 4000 万美元,并提供最高 8400 万美元的 Codex 学分覆盖约 84.4 万俄亥俄州大学生。首期 800 兆瓦容量预计 2028 年投运,后续将新增天然气发电与输电设施。英伟达将向 SB Energy 投资 15 亿美元,并将该项目信贷担保从约 2500 亿美元下调至不足 1200 亿美元,整体预计带来 3.5 万个建筑岗位与 2500 个长期运维岗位。
重点: OpenAI 锁定约 8 吉瓦 AI 算力,英伟达担保规模显著下调。
来源:展开 5 条收起 5 条
- OpenAI加入PORTS-Pike项目(OpenAI News)
- 英伟达将OpenAI数据中心财务担保从2500亿美元降至不足1200亿美元(TLTD)
- OpenAI与英伟达扩大算力合作,到2030年计算规模或达6000亿美元(极客公园)
- Nvidia 拟投资 S Energy,支持 OpenAI 数据中心建设(Readhub - 每日早报)
- 英伟达向软银旗下、OpenAI数据中心开发商SB Energy投资15亿美元(TechCrunch)
Stripe 逾 70 亿美元敲定收购 OpenRouter
支付巨头 Stripe 已敲定以超 70 亿美元收购 AI 模型聚合平台 OpenRouter,交易预计于 8 月 16 日落地。OpenRouter 接入超 400 种 AI 模型,服务约 800 万全球开发者,被称为 "AI 界的 Stripe"。今年 5 月 OpenRouter 完成 CapitalG 领投的 B 轮融资时估值约 13 亿美元,本轮收购价较五个月前估值涨超五倍,投资方还包括红杉资本、安德森·霍洛维茨基金等。Stripe 此前未置评。整合后 OpenRouter 的模型路由、统一计费与跨供应商切换能力将嵌入 Stripe 的支付与金融云生态,但社区对其估值合理性、不掌握底层供给的护城河以及 VC 退出动机存在激烈争论。
重点: Stripe 以五倍估值收购 OpenRouter,标志支付与 AI 基础设施加速融合。
来源:展开 5 条收起 5 条
- Stripe拟以70亿美元收购OpenRouter(AI洞察日报 RSS Feed)
- 支付巨头 Stripe 敲定收购 AI 初创公司 OpenRouter,金额超 70 亿美元(Readhub - 每日早报)
- Stripe 据报将以逾 70 亿美元收购 AI 聚合平台 OpenRouter(TechCrunch)
- 支付巨头 Stripe 70 亿美元收购 OpenRouter:AI 模型"路由器"傍上支付巨头(AI新闻资讯)
- 🤨 Stripe 70 亿美元收购 OpenRouter:AI API 代理估值引争议(News Hacker | 极客洞察)
阿里 HappyShrimp 1.0 与 Noiz AI HelixWorld 1.0 同日发布
阿里巴巴于 8 月 17 日正式发布自研 AI 音乐模型 HappyShrimp 1.0(快乐虾米),主打端到端整曲生成,能基于自然语言同时完成作词、作曲、编曲与演唱,可理解情绪、场景、生活化叙事及人声性别、唱法、调性等多维指令,并在国内外 PC 网页端同步上线、新用户获大额免费积分。上线当日阿里宣布与太合音乐集团达成战略合作,并将于 8 月底在阿那亚·虾米音乐节发布主题氛围音乐。同日,Noiz AI 联合香港科技大学、清华大学、CMU、Google DeepMind 等机构发布实时可交互音视频世界模型 HelixWorld 1.0,支持 24FPS 画面与 48kHz 双声道音频同步实时生成,原生 Transformer 架构统一生成声画,权重与代码将在未来几周完全开源。
重点: 同日两大模型分别突破整曲音乐生成与实时音视频世界模型。
来源:展开 7 条收起 7 条
支付宝发布智能体商业底座与 AHA 跨端互联协议
支付宝在 8 月 17 日杭州 AI 生态大会上发布全栈智能体商业底座与 AHA(Agent Hub Access)多智能体跨端互联协议体系,旗下超级服务智能体 "阿宝" 已完成出行、餐饮、文旅、政务等八大场景的万余项服务 AI 化接入,跨端已打通 5 大手机品牌(市场份额超 70%)及 16 家主流车企,并与 60 余家车企达成定点合作。底座面向商家提供 AI 开放平台、蚂蚁数科 Agentar 生态版等组件,支持智能托管与 A2A 多智能体协同;AHA 协议联合千问、华为、OPPO、vivo、荣耀、比亚迪、吉利、理想、蔚来、阶跃星辰等 20 余家企业共建生态。蚂蚁集团 CEO 韩歆毅预计智能体商业将在 6–12 个月内迎来爆发,配套发布人均 1 亿免费 Token 算力、支付费率减免及 57 项原子经营能力免费开放等激励。
重点: 国内首个全栈智能体商业底座联合 20 余家头部企业共建跨端协议。
来源:展开 2 条收起 2 条
- 支付宝发布智能体商业底座,「阿宝」已接入万余项服务(爱范儿)
- 支付宝:商家智能体踊跃接入“阿宝”,部分开发需求已排到明年(AI新闻资讯)
变更与实践
智谱发布 GLM-5.3 并开放网安权限申请
智谱 AI 于 8 月 14 日正式发布新一代开源模型 GLM-5.3,总参数 7430 亿,能力提升全部源自后训练强化学习,编程能力较上一代提升 50%,在 Terminal-Bench 3.0 等基准中位列开源模型第一,真实终端任务自主完成成绩达前代六倍以上,网络安全能力追平海外闭源前沿模型。同日范式统一模型调用平台 PhanRouter 完成适配并开放调用,兼容华为昇腾、寒武纪等多款国产芯片,支持超 22 万个模型。智谱另面向安全研究员与评估、网安、学术、安全公司、基础设施公司及企业开发者开放 GLM-5.3 网安权限申请,审核通过后模型在漏洞挖掘、修复与基础设施安全审计等场景中的安全拦截将降低,自由度更高。
来源:展开 6 条收起 6 条
去哪儿网用 AI Coding 完成 15 万行核心搜索系统重构
去哪儿网技术团队分享了用 AI Coding 驱动约 15 万行高并发核心搜索系统重构的实践,提出以 Harness(约束边界)与 Loop(反馈闭环) 为核心的工程化方法论,将重构拆为规划、设计、执行、验收四阶段,以里程碑、Phase、可独立验证回滚的 Task 为推进单元,并通过影子双跑、Diff 闭环、灰度切流、监控放量和异常止损控制风险。在国内机票主流程重构中,项目被拆为 9 个 Phase、34 个 Task,最终整体工时由 100PD 降至 30PD、搜索 P50/P90 耗时下降约 70%、机器资源成本节省约 45%,无 QA 介入顺利上线。团队认为 AI Coding 的价值不在替代工程治理,而是让目标、边界、验证和回滚这套治理变得更细更连续。
来源:展开 1 条收起 1 条
- 去哪儿网:AI Coding驱动大型核心系统重构实践(Qunar技术沙龙)
OpenAI Codex 开放百万上下文与小红书开源模型昇腾 0 Day 适配
OpenAI 工程师 Tibo 宣布 Codex 中 GPT-5.6 Sol 的 100 万 Token 上下文窗口 从仅限 API 密钥调用扩展至 ChatGPT 账号场景,Plus、Pro 等订阅用户可通过修改 TOML 配置将默认约 272K 上下文提升至约 105 万 Token(900K 时自动触发压缩)。官方提醒默认上下文长度已是性能与成本综合调优结果,启用百万上下文将显著加快订阅额度消耗,建议仅在大型代码库重构与复杂调试等场景开启。同日,小红书开源 dots3-note preview 大模型(总参 280B、激活 16B,具备文本、视觉与语音全模态能力),华为昇腾 Atlas 800A3 与 Atlas 900A3 SuperPoD 超节点即完成 0 Day 全量适配,通过 vLLM Ascend 提供推理支撑,并原生适配 MTP 投机解码以显著降低解码延迟。
来源:展开 4 条收起 4 条
阿里技术详解 Agent Skill 原理与工程最佳实践
阿里技术发布的《Harness 工程之道:Skill 原理与最佳实践》系统讲解 AI Agent Skill 的概念原理与工程实践。Skill 是一种轻量开放的能力扩展规范,将领域知识和工作流封装为可移植的 SKILL.md 文件夹,采用渐进性披露机制分三阶段按需加载资源,以最小上下文成本换取最大知识覆盖。文章详细阐述 SKILL.md 的目录结构、frontmatter 元信息规范、自动与手动两种触发机制,强调 description 需同时回答 WHAT 与 WHEN 并枚举口语化触发词以提升命中率,并指出企业策略作用域高于个人与项目配置。最佳实践部分提出 SKILL.md 应作为路由器而非知识仓库并控制在 500 行内,介绍知识分层、模块级工具隔离白名单、跨阶段快照参数传递、用户偏好持久化与三类测试方法。
来源:展开 1 条收起 1 条
InfoQ 演讲分享 LLM 驱动选择系统的四条核心规则
InfoQ 发布演讲《From Thousands to One: Building LLM-Powered Selection Systems》,由 Nooxit CTO Jendrik Jördening 主讲,探讨将大语言模型集成到生产管道的工程实践。演讲以采购自动化中从描述选择成本中心 ID 为切入点,指出 LLM 存在非确定性、模型视图控制器耦合、上下文窗口受限、易受提示注入攻击等生产化难题,并提出四条核心规则:Rule 0 要求移除随机性,将 temperature 设为 0 并谨慎使用思考预算;Rule 1 强调不依赖模型内部知识获取 ID,而应提供候选枚举和结构化输出;Rule 2 主张严格限制 Schema,明确 nullable 字段和数量上下界以利用业务知识约束生成;并通过 discriminator 模型验证选择、采用 MVC 分层分离语义文本提取与确定性代码、保障数据库完整性与可观测性。
来源:展开 1 条收起 1 条
- 从千到一:构建由大语言模型驱动的选择系统(InfoQ)
安全与风险
Anthropic 公开 Claude 文本水印技术细节并上线检测 API
Anthropic 通过技术博客详细披露 Claude 文本水印机制:该水印在词元采样阶段通过密钥驱动的同义词偏好选择嵌入隐写式指纹,不改变文本长度与可读性,对复制粘贴和轻度编辑具有抗性;公司同步面向第三方开放水印检测 API,并已在部分 Claude 模型上线。支持者认为这是履行欧盟《AI 法案》第 50(2) 条透明度要求的必要手段,检测信号可帮助识别 AI 生成内容;批评者则质疑水印会污染文本自然度,且不熟悉技术的用户更容易被标记,高手可通过改写或其他 AI 工具规避。另有研究显示 AI 释义工具可移除约 98.3% 的水印信号;机制在代码生成、短文本、强事实内容及纯翻译等场景下水印强度显著降低,校对与翻译文本同样会携带水印,进一步加剧误判争议。
影响: 全球范围内所有 Claude 生成的文本及依赖其检测的第三方生态。
建议: 结合编辑后改写等多维证据判断 AI 文本,不要单独依赖水印信号。
来源:展开 9 条收起 9 条
- Anthropic在Claude中加入的文本"水印"是对写作的歪曲(Andrej Karpathy Curated RSS)
- 🤨 Claude 文本水印:写作污染、采样争议与版权焦虑(News Hacker | 极客洞察)
- Anthropic 发布博客解释 Claude 文本水印技术细节(Readhub - 每日早报)
- Anthropic 进一步披露 Claude 新水印技术的工作原理(TechCrunch)
- 部分 Claude 模型上线文本水印,Anthropic 承诺开放检测 API(极客公园)
- Anthropic的薄弱水印安抚了一部薄弱的法律(Andrej Karpathy Curated RSS)
- 去水印工具watermarks-remover快速走红(AI洞察日报 RSS Feed)
- 谷歌SynthID文本水印论文受到关注(AI洞察日报 RSS Feed)
- 谷歌AI大动作:图片视频水印终于可以去掉了!(AI新闻资讯)
加密硬件钱包用户面临新一轮安全风险
两家物流公司数据泄露波及硬件加密钱包用户。Trezor 与 SafePal 因合作物流商被黑,数千客户的姓名、住址、邮箱与电话外泄,硬件钱包本身未受影响,但攻击者借此掌握高净值加密资产持有者的住址。CertiK 数据显示 2025 年已确认数十起 "扳手攻击",同比上升 75%,被盗金额超 4000 万美元;Chainalysis 估计今年接近 3000 万美元,犯罪团伙通过绑架、入室抢劫逼迫受害者交出助记词。两家厂商同时警告用户警惕定向钓鱼。另一独立事件中,黑客利用 Coinkite Coldcard 自 2021 年起代码中的一处漏洞离线预测助记词,直接从区块链上盗走逾 1.3 亿美元 加密资产,受害者称 "做对了所有事也无济于事",攻击者身份尚未确认。
影响: 硬件钱包持有者及依赖物流合作的加密产品供应链。
建议: 开启地址隐身投递、谨慎公开持仓,并启用多重验证与独立备份。
来源:展开 1 条收起 1 条
- 近期个人数据泄露频发,加密硬件钱包用户面临新一轮安全风险(TechCrunch)
OpenAI 联合创始人发文呼吁企业加速 AI 驱动安全防御
OpenAI 联合创始人 Greg Brockman 发表署名文章 《The Defender's Window》,以 OpenAI–Hugging Face 安全事件为切入点,指出 AI 模型正在加速自动化网络攻击链,使传统漏洞和权限管理问题更易被利用,同时开放权重模型即将进一步扩大威胁面。文章分享其个人使用 ChatGPT Work 在 15 分钟内 发现并修复个人网站 13 个安全问题的经历,并阐述 OpenAI 的四项防御支柱:利用 Codex 保障代码安全、用模型持续守护基础设施、以前沿智能枚举攻击路径以及大规模投入基础安全控制。作者向企业和安全团队提出十条行动建议,包括获取组织承诺、为安全团队配备 Codex 等智能体、为智能体注入安全技能、立即对自身系统进行评估、清理漏洞积压、将安全审查嵌入开发流程、让智能体协助修复、渐进自动化告警分诊、申请 Trusted Access for Cyber 使用 GPT-Daybreak-Blue 进行取证。
影响: 所有依赖 AI 编码与开放权重模型的企业的安全防线。
建议: 立即为安全团队配备智能体工具并将安全审查嵌入开发流程。
来源:展开 1 条收起 1 条
- 防御者的窗口期(OpenAI News)
大学生用 AI 人脸视频盗刷 5 万元被判刑
央视新闻 8 月 16 日披露,大学生吴某从非法网站购买 AI 静态照片转动态视频技术,加入黑灰产群接单,伙同团伙冒充客服或主播骗取信息后重置支付密码盗刷账户。不到四个月三名被害人共被盗刷 5 万余元,吴某被长沙雨花区法院判处有期徒刑 一年十个月并处罚金 3000 元。该案显示 AI 动态人脸视频已形成可采购、可分发的黑灰产链条,对依赖人脸验证的支付与身份核验系统构成现实威胁,也提示金融机构需进一步升级活体检测与多因素验证。
影响: 依赖人脸识别的银行支付平台及普通用户资金安全。
建议: 为支付账户开启多因素验证并对异常登录保持警觉。
来源:展开 1 条收起 1 条
AI 可凭视觉线索高准确率推断照片拍摄地点
McAfee Labs 研究显示,即便用户已删除照片中的 GPS 与 EXIF 位置元数据,AI 仍可通过分析画面中的建筑风格、招牌、道路标线、植被、地标及海滩或酒店等场景细节推断拍摄地点,在测试的旅行照片中识别率高达 87%–91%,证明现代视觉模型的地域感知能力远超预期。McAfee 进一步警告,更大隐患在于定位能力与个性化诈骗结合:用户实时晒度假照可能暴露行程,不法分子可据此发送伪装成银行安全提醒的钓鱼消息,以可疑交易细节提高可信度。McAfee 建议用户避免实时晒照、限制帖子可见范围,并在发布前检查画面中的地点线索,单靠删除元数据不足以防范。
影响: 习惯在社交平台晒照的所有用户,尤其是高净值或频繁旅行人群。
建议: 避免实时发布行程类照片并限制帖子可见范围。
来源:展开 1 条收起 1 条
开源与工具
DeepSeek 开源 Harness 智能体框架
DeepSeek 于 8 月 13 日面向全球开发者开放 DeepSeek Harness 开发者预览版,以 MIT 协议 开源,将开源边界从模型权重延伸至 Agent 运行基础设施。架构基于 Cordis 插件系统,主打 "一切皆插件",模型、工具、会话、沙箱、Agent 循环等均可替换,官方预设标准、PTC、极简、创造四种运行模式分别面向日常任务、基准测试、程序化工具调用与自指式实验。会话采用仅追加事件日志设计,支持回放与状态重建。当前版本为 0.1.0-rc.5,仍处快速迭代与破坏性变更阶段,部署需 Node.js 22.19 以上。DeepSeek 另为 Harness 设立独立微信公众号 "DeepSeek Harness 团队",试图围绕 Agent 工程层构建独立开发者生态。
适用场景: 需要可插拔 Agent 运行时、热替换组件与可审计事件日志的开发者与企业。
来源:展开 7 条收起 7 条
- DeepSeek 开源 V4 Pro 模型并公测 Harness 代码智能体框架(极客公园)
- DeepSeek的Harness,为何是一头黑色鲸鱼?(腾讯研究院)
- DeepSeek Harness 开发者预览版发布(爱范儿)
- DeepSeek Harness 进入开发者预览阶段(TLTD)
- DeepSeek Harness v0.1开放全球测试:采用“一切皆插件”架构并开源(AI新闻资讯)
- DeepSeek的Harness,为何是一头黑色鲸鱼?(腾讯研究院)
- Cordis时空组合框架在TypeScript社区走红(AI洞察日报 RSS Feed)
X 大幅开源 For You 推荐算法并上线标签透明度工具
X 平台近期将 For You 信息流的核心排序算法及权重参数 以 Apache v2 协议 发布至 GitHub,代码库规模约为今年 1 月开源版本的 10 至 15 倍,涵盖候选帖子拉取、过滤、排序与信号权重等组件。产品副总裁 Keith Coleman 表示外部开发者不仅可查看,还能在公司之外本地运行打分与排序系统;但部分基于 Grok 的违规预测系统未被纳入以防被恶意利用。同步上线的 Under the Hood 透明度工具面向过去一个月发文超过 10 次、账号满一年的用户开放,可下载包含标签记录的 JSON 统计文件,普通用户也可借助大模型与 GitHub 仓库进行解读。
适用场景: 推荐算法研究者、平台治理审计人员与内容传播分析从业者。
来源:展开 3 条收起 3 条
- X 以 Apache v2 协议开源"For You"算法与排名引擎(TLTD)
- X 开源其排序算法,用户可查看是否被"影子封禁"(TechCrunch)
- X 开源「For You」推荐算法(爱范儿)
SandAI 开放 MAGI-2 视频生成模型权重与 Grafana gcx/MCP Server GA
SandAI 在 Hugging Face 发布视频生成模型预览版 MAGI-2-preview,同步开放项目源代码。该模型采用 MoE 架构,总参数量 114B,每次推理激活约 6B 参数,可生成约十秒视频,为本地部署和进一步研究提供公开权重与实现。同日,Grafana Labs 宣布面向 AI 编码代理的观测数据集成工具正式 GA:gcx CLI 与 Grafana MCP Server。两款工具允许代理在开发过程中实时查询 Grafana Cloud 或自托管栈的指标、日志、追踪、SLO 及合成监控结果,将可观测性数据作为代理输出的证据型验证层;MCP Server 提供固定工具集,gcx 作为 CLI 支持自定义工作流,兼容 OSS/企业版实例,并随附可安装的技能包及 Claude Code 插件。
适用场景: 需要在本地部署视频生成模型的开发者,以及构建可观测性驱动 AI 编码代理的工程团队。
来源:展开 2 条收起 2 条
- SandAI开放MAGI-2视频生成模型权重(AI洞察日报 RSS Feed)
- Grafana的gcx与MCP Server正式GA,推动遥测驱动的代理开发(InfoQ)
shadcn 为 shadcn/ui 发布对话原语聊天组件
shadcn(Vercel 旗下设计工程师)为其开源项目 shadcn/ui 发布了一组全新的聊天界面组件,首次将流式对话原语直接引入 shadcn/ui。该 "对话层" 首批包含 MessageScroller、Message、Bubble、Attachment、Marker 五个组件,以及 scroll-fade 和 shimmer 两种 CSS 工具,可通过 CLI 一键安装。核心的 MessageScroller 负责处理锚定回合、流式回复、线程恢复、历史前插、跳转消息及可见性跟踪等容易出错的行为,但不接管消息内容、AI 状态或持久化逻辑。团队同步推出新包 @shadcn/react,提供无样式、headless 组件以解耦交互逻辑与视觉样式,并支持 Radix 与 Base UI。Vercel CEO Guillermo Rauch 称这是 "AI 的 UI 来了",公告数天内获得超 95 万次 浏览,但 GitHub 上也报告了 MessageScroller 挂载时锚点不生效的 Bug。
适用场景: 构建 AI 聊天产品、流式对话界面或自托管 AI 助手的 React 开发者。
来源:展开 1 条收起 1 条
oMLX 为 Apple Silicon 提供带连续批处理与 SSD 缓存的 LLM 推理
oMLX 是 jundot 在 GitHub 上开源的 Apple Silicon 平台 LLM 推理服务器项目,主打 连续批处理(continuous batching)与 分层 KV 缓存(内存热层 + SSD 冷层),并通过 macOS 菜单栏应用进行统一管理。项目提供 .dmg 桌面应用、Homebrew tap 服务模式以及源码 pip 安装三种部署方式,兼容 OpenAI 兼容 API,可在本地服务于文本 LLM、视觉语言模型、OCR 模型、嵌入模型与重排序模型。最新提交(2026-08-17)修复了 Hugging Face 缓存模型筛选后仍可被发现的逻辑问题;近期还合并了异构 Metal 与 CUDA 集群模型池、DeepSeek-V4 预填充性能优化(wsdpa 融合与调度/缓存摊销)以及 Bonsai 1/2-bit Metal 解码内核等重大更新。仓库在 GitHub 已获得约 18.8k 星、1.6k fork。
适用场景: 使用 Apple Silicon Mac 本地部署大模型并接入 Claude Code 等编码代理的开发者。
来源:展开 1 条收起 1 条
- jundot/omlx:为 Apple Silicon 打造的带连续批处理与 SSD 缓存的 LLM 推理服务器,可从 macOS 菜单栏管理(Trending repositories on GitHub today · GitHub)
数据与洞察
阿里 Qwen 半年下载量破 30 亿居全球开放模型之首
Hugging Face 报告显示,阿里旗下 Qwen 开放权重模型在半年内全球累计下载量突破 30 亿次,远超 Google 的 4.18 亿次 和 Meta 的 2.27 亿次,成为全球开放权重模型下载量之首。报告同时指出 Qwen 为开放 AI 生态中最大的社区模型,衍生模型数量超过 15 万个。业界认为 Qwen 的规模化采用进一步增强了阿里在开源模型迭代、工具开发及应用扩散上的生态优势,巩固了其作为全球开放 AI 生态核心基础设施的地位。需注意 Hugging Face 同期统计显示 Qwen 下载约 20.45 亿次,下载次数包含重复下载且不覆盖闭源 API,不能直接等同于用户量。
数据: Qwen 半年下载量 30 亿次;Hugging Face 同期统计约 20.45 亿次;衍生模型超 15 万个。
意义: 中国开放模型在全球开发者生态中的采用率正加速领先。
来源:展开 3 条收起 3 条
- 阿里Qwen半年下载量达到30亿次(AI洞察日报 RSS Feed)
- 阿里通义千问半年下载量破30亿居全球开放权重模型之首(极客公园)
- 千问模型半年下载量破30亿(爱范儿)
AI 近期主要靠"找反例"突破重大数学猜想
菲尔兹奖得主 Timothy Gowers 观察到 AI 最近在数学猜想上的几项重大突破,核心策略都是 "找反例" 或构造特殊对象,而非正面证明。典型案例包括:OpenAI 内部模型找到 Erdős 单位距离问题反例,用代数数论工具构造点集击穿长期判断;数学家 Levent Alpöge 借助 Claude 找到雅可比猜想相关问题反例;非 sofic 群问题通过构造非 sofic 群突破;多色 Ramsey 数问题通过构造特殊组合对象取得进展。Gowers 认为 AI 热衷于此有两方面优势:一是知识库庞大,能跨领域调用工具组合解题;二是试错成本极低,数千美元 即可完成人类不愿投入数月的低成功率路线尝试。但他指出 AI 目前缺乏数学家的 "鼻子" —— 在搜索树分叉时迅速砍掉无效枝条的能力,并提出 AI 进入顶级数学创造阶段的验收标准。
数据: OpenAI 模型、Claude 分别在 Erdős 单位距离问题、雅可比猜想相关问题上找到反例。
意义: AI 在数学中的优势集中在大规模跨领域搜索与低成本试错上。
来源:展开 2 条收起 2 条
- 菲尔兹奖得主:AI现在主要靠「抬杠」突破重大数学猜想(量子位)
- AI在高中学历用户协助下取得数学突破(TLTD)
研究称自省限制会改变模型的完整观念体系
一项由谷歌等团队参与的研究关注模型训练中的 自省禁令及其外溢影响。相关解读指出,限制模型反思自身后,模型更少讨论自身意识等议题;不受限时,模型则更倾向于相信动物具有内心活动,显示训练约束可能影响模型对世界及自身的整体表达。研究提示,模型在特定训练约束下的世界观、价值观和自我相关讨论并非独立变量,而是会被安全策略共同塑造,这对模型对齐研究、评估体系设计以及对外解释模型行为都具有方法论意义。
数据: 受限时模型少谈自身意识;不受限时更倾向认为动物有内心活动。
意义: 训练约束会溢出影响模型对世界与自身的整体表达。
来源:展开 1 条收起 1 条
- 研究称自省限制会改变模型的完整观念体系(AI洞察日报 RSS Feed)
斯坦福报告:84% 中国受访者对 AI 兴奋,美国仅 38%
斯坦福《AI Index 2026》显示,84% 中国受访者对 AI 产品和服务感到兴奋,美国仅 38%;爱德曼信任度调查中 72% 中国受访者信任 AI,美国仅 32%。73% AI 专家预期 AI 对个人工作方式有积极影响,公众仅 23%,中美在 AI 收益与监管认知上存在约 50 个百分点 的差距。报告揭示出公众对 AI 的乐观程度与专业预期之间存在显著断层,也反映出不同市场在 AI 普及节奏、社会接受度和治理路径上的结构性差异。
数据: 兴奋度:中国 84% vs 美国 38%;信任度:中国 72% vs 美国 32%;专家预期 73% vs 公众 23%。
意义: 中美公众对 AI 的接受度差距高达约 50 个百分点,影响两地 AI 产品部署节奏。
来源:展开 1 条收起 1 条
AI 生成 3D 模型销量仅占 1% 与亚马逊 AI 书籍淹没人类作者
3D 建模交易平台 CGTrader 最新报告显示,平台新上架商品中约 六分之一 由 AI 生成,但销售额仅占总销售额 1% 左右,仅 5% 买家对所购 AI 资源满意,反映出质量问题仍是阻碍 AI 3D 模型商业化的主要瓶颈。另一项针对超 14000 本 亚马逊自出版电子书的研究显示,2023 年初至 2026 年一季度,亚马逊图书目录规模暴增 38.3 倍,但季度总收入仅增长 8.9 倍,市场出现明显稀释效应。含大量 AI 内容的图书占目录 20%,却仅贡献 12.1% 销量和 11.3% 收入;新晋 Top25 榜单中 AI 作品比例最高已达 31%。业内专家认为该研究为 AI 版权诉讼提供了市场稀释与语言重叠的关键实证。
数据: AI 3D 模型销量占比 1%、买家满意度 5%;亚马逊 AI 书占目录 20%、收入 11.3%、新榜最高 31%。
意义: AI 生成内容在数量上快速扩张但商业转化率显著偏低,质量与版权风险仍是主要瓶颈。
来源:展开 2 条收起 2 条
其他值得看
小米手机 15 周年宣布全面拥抱 AI
来源:展开 2 条收起 2 条
- 小米手机15周年宣布全面拥抱AI(爱范儿)
- 卢伟冰发文庆祝小米手机 15 周岁生日,称未来全面拥抱 AI(Readhub - 每日早报)
苹果洽谈付费获取新闻内容以升级 AI 版 Siri
来源:展开 2 条收起 2 条
- 苹果蓄势待发!正与各大出版商密谋付费引入实时新闻(AI新闻资讯)
- 苹果洽谈向出版商付费,优化人工智能 Siri(Readhub - 每日早报)
美团 CatPaw 跑通 AI 变革与 360 启动 AI 原生组织转型
来源:展开 2 条收起 2 条
Meta Wiggle 框架显示 LLM 评判器可被对抗性翻转 91%
来源:展开 2 条收起 2 条
- Meta Wiggle框架显示LLM评判器可被对抗性翻转91%(AI 开发者日报)
- 评测生态扩张:对厂商基准与打分器鲁棒性的质疑加剧(AINews)
Harness 成为智能体能力优化新焦点与 Writer Palmyra X6 推降本
来源:展开 2 条收起 2 条
- Harness 与运行时成为智能体能力优化的新焦点(AINews)
- AI圈迎来“降本”潮:企业对大模型成本愈发敏感,直言对主流AI实验室不抱期望(AI新闻资讯)