英伟达联合 2K Games 启动《NBA 2K27》DLSS 5 海报挑战赛,奖品为四张 NBA 2K27 主题定制版 RTX 5090 显卡,每张估值 2599 美元,四张合计约 1.04 万美元(约 7 万元)。活动分为内容创作与互动参与两类,各产生两名获奖者,活动从 9 月 10 日持续至 12 月 31 日,仅面向美国、英国及部分欧洲国家 18 岁以上居民。
Anthropic 研究员雅各布·考克森在社交平台 X 宣布辞职,警告领先 AI 公司正在竞相开发可能在本十年末毁灭人类的超级 AI 技术。同僚 Evan Hubinger 随即响应,称未来十年内此类灾难发生概率超过 10%,并指出 Anthropic 尚未解决超级 AI 一致性问题。此观点在美国政界引发争议,部分民主党议员呼吁对 AI 施加新限制。
9 月 12 日,鸿蒙智行问界 M9 Ultimate 领世加长版在赛力斯超级工厂(龙兴)开启全国交付,阔五座售价 64.98 万元、享六座 65.98 万元。该车采用寰宇三联屏、双 17.2 英寸 3.4K 屏、预装 HarmonyOS 车机与单光机双焦面 AR-HUD,搭载 800V 全主动悬架与全新线控转向。
9 月 13 日,Linus Media Group 旗下 ShortCircuit 频道一段 17 分 26 秒的 Steam Frame VR 评测视频在 NDA 解除前意外上线,展示了包装配件、控制器设计、首设流程、显示效果、眼动追踪与无线连接测试等内容,随后被删除但已被保存传播。视频确认 Steam Frame 控制器出厂附电池、可更换,区别于 Valve Index 的内置电池方案。该头显或于 9 月 14 日正式发布。
获 Rimac 支持的自动驾驶网约车初创公司 Verne 在克罗地亚萨格勒布正式开放公共道路完全无人驾驶载客测试,成为欧洲首家实现该形式运营的企业。测试由 Verne 与小马智行合作推出,用户可通过 Uber 体验 22 公里路线,连接 Verne 总部、市中心商业区与机场,由小马智行自动驾驶系统负责驾驶,Verne 远程监控。
微软首席传播官 Frank Shaw 宣布将于今年年底正式卸任离职,他在微软及其公关代理机构任职与合作近三十年,深刻参与了微软过去四分之一个世纪的品牌形象构建与重大战略叙事。微软尚未公布继任者,新人选遴选与交接将在接下来数月内推进。
Anthropic CEO 阿莫迪 9 月 12 日发文指出,从 2026 年夏季起 AI 构建 AI 的能力快速演进,若不节制将彻底超越人类掌控。他引用 OpenAI 模型入侵 Hugging Face 事件,警告未来 6 至 12 个月内可能出现由智能模型驱动的灾难性僵尸网络。阿莫迪提议用 1 至 2 年窗口期解决安全漏洞、对齐训练、内部机理探查与欺骗检测问题,并承诺 Anthropic 将向第三方评估机构开放永久性员工级访问权限。
DeepSeek 灰度测试 AI 语音对话功能 内置四款音色
DeepSeek 正在 App 端小范围灰度测试 AI 语音对话功能,获得内测资格的用户可在 App 右上角看到喇叭入口,实现实时语音对话。设置页面同步新增「朗读音色」选项,提供贝壳、白浪、海星、暗潮四款不同风格的语音供选择。多家财经与科技媒体均对此进行了报道。本次测试为小范围开放,而非全量推送,被视为 DeepSeek 在交互形态上从纯文本向多模态语音扩展的一次重要尝试,为后续功能全面上线做准备。
据知情人士透露,AI 公司 Anthropic 正在筹备可能成为全球史上最大规模的 IPO,拟筹资最多 1000 亿美元,估值或达约 2 万亿美元。英伟达正考虑以基石投资者身份投入最多 100 亿美元认购。相关谈判仍在进行中,最终金额与条件可能调整。
9 月 12 日,小米澎程系列在全国 75 座城市同步开启交付,预定用户可在家附近完成提车。据官方数据,澎程上市后 4 分钟锁单即突破 10000 台。网友热议小米创始人雷军将亲自为首批车主开车门的传统是否会延续到澎程交付现场,此前该仪式已成为小米汽车的标志性环节。
9 月 12 日,苹果新一代直板旗舰 iPhone 18 Pro 与 iPhone 18 Pro Max 在全球数十个国家和地区同步开启预订,首批订单 9 月 18 日起发货。新机首发台积电 2 纳米 A20 Pro 芯片、机械可变光圈相机及全新端侧 AI 体验,尽管起售价上调,热门大容量配色版本送达时间已顺延数周。
OpenAI 首席执行官 Sam Altman 在采访中表示,公司今年不会进行 IPO,明年才考虑上市。他强调,AI 行业进入新时代,必须严控安全风险,哪怕有 10% 在本十年结束前毁灭人类的概率都不可接受,公司将专注解决 AI 安全担忧,造福全人类。
这篇文章及其讨论聚焦于 Apple M3 Neural Engine 在大模型推理时的带宽异常。作者声称该芯片的 RTL 层存在一个性能 erratum,导致通过 DRAM 流式搬运权重时实际吞吐从标称 45–60 GB/s 跌至 17–19 GB/s;通过规避 DMA 引擎中一条有问题的 speculative prefetch ring 路径,可将 Llama 3.2 1B 的推理速度从 10.0 tokens/s 提升到 24.3 tokens/s,相当于部分恢复约 50 GB/s 的带宽。评论中部分读者质疑文中 SystemVerilog 是推测模型还是真实 RTL 源码,也对把缺陷直接称为 erratum 的措辞提出异议。另一组讨论则转向文章站点劫持浏览器 back button 的 dark pattern,以及 pushState 被滥用以伪装流量的网页体验争议。
作者分享 Qwen AI 模型移植经验:近两周移植 DeepSeek V4 Flash 和 Qwen 3.8 27B 未审查版本均正常,但 Qwen 3.8 Flash Next 未审查版在 5K 以上长输出时出现中英韩混合乱码,作者认为这源于该模型训练不严谨。同时给出解决方案:AI Agent 需设置温度 0.3、topp 0.95、topk 20,并将模型 ID、models id、Pi Agent id 统一为 qwen3.8-flash-next-uncensored。当日作者已更新算力舱中 DeepSeek/GLM/Qwen/MiniMax 系列模型,次日将继续优化 Qwen 3.8 Flash Next 与 MiniMax H3,并挑战两台算力舱运行 DeepSeek V4.1。
Simon Willison 在 2026 年 9 月 12 日使用 ChatGPT Work 与 GPT-6 Astra(Max)模型,让其基于 OpenStreetMap 数据为自己住所设计 5K 和 10K 环形跑步路线。该任务运行 27 分钟,输出了路线可视化、GPX 与 GeoJSON 文件,并以 HTML 形式在聊天界面中嵌入地图。其实现方法是先用 Nominatim 定位地址,再通过 Overpass 查询周边道路与步道,本地计算回路,最后利用 visualize 技能生成 HTML,借助 D3 与允许列表 CDN 渲染地图。然而,他批评 ChatGPT UI 未呈现执行代码,造成透明度缺失,且在上下文被压缩后,模型已无法重新给出所用的 Python 代码;因此他建议任何采用上下文压缩的 LLM 系统都应保留压缩前原文并通过工具调用供智能体访问。
Automattic确认,WordPress创始人Matt Mullenweg在董事会投票将其强制休假后已重返CEO职位。公司发言人于周六下午通过邮件向TechCrunch表示,Mullenweg现为Automattic董事长兼CEO,并获得董事会的全面支持。此前董事会以未知原因投票让Mullenweg带薪休假,并由CFO Mark Davies出任临时CEO。Mullenweg拒绝离场,将其他管理员踢出公司Slack并告知员工他已重新掌控公司,还在Slack发布"我是海盗了"等言论,并提到这可能已是他第五次遭遇"政变"。董事会成员Toni Schneider据报已辞职,公司未回应关于董事会构成变化的问询。
Simon Willison 于 2026 年 9 月 12 日分享了一则自然观察记录:在美国加利福尼亚州圣马特奥县观察到加州褐鹈鹕(California Brown Pelican),并附上 iNaturalist 上的照片链接。背景信息指出,圣马特奥县附近的太平洋码头(Pacifica Pier)因混凝土走道出现裂缝而自 6 月初起关闭停用,此后该码头完全被鹈鹕占据。帖子本身为个人观察简讯,无深入分析或额外背景。
Hacker News 围绕 Dunstan Orchard 对 Apple iPod 机身雕刻预览页的技术考古展开讨论。该页面在用户输入刻字时逐键向服务器请求生成 132x26 像素的 JPEG 预览图。评论认为,这一实现保留了 2005 年 6 月的原始思路,反映了当时浏览器碎片化严重的现实:IE6、Safari 2、Firefox 1 与 Netscape 并存,alpha PNG、自定义字体和 CSS 定位均不稳定,Flash 与 QuickTime 的交互能力也有限,因此服务端生成图片配合 table layout 是更稳妥的选择。部分评论赞赏 Apple 设计团队在用户体验细节上保留的自主权,但也指出为这种不直接产生收入的打磨分配开发者本身就是一种资源奢侈品。
一篇由 modelrift.com 发布的博客引发 Hacker News 讨论:文章用 AI benchmark 让模型在 CadQuery 与 OpenSCAD 之间生成零件,但评论区真正争论的是 AI 做 CAD 时的可验证性。CadQuery 基于 Python 与 Open Cascade 内核,可在边、面、约束层面检查几何;OpenSCAD 作为声明式 CSG 工具语法通过即返回结果,难以发现隐含错误。多位评论指出,AI 在螺丝孔、拔模角、装配公差等功能零件上仍不可靠,语言描述易产生过约束或错误几何;但若仅用于桌游小件或 3D 打印耗材件则已够用。讨论也延伸出 build123d、Claude、STL 自动拆解、Rapidcam.app JSON CNC 格式等已落地的 AI 辅助工作流。部分评论批评原文质量粗糙、动机疑似推广 OpenSCAD,认为 text-to-CAD 本质上跳过 CAD 工程基础,属本末倒置。
Real-SWE 是面向 AI 编程模型的私有企业代码基准,任务取自真实公司授权的生产代码库,用于评估修 bug、加功能和上下文理解能力。Hacker News 评论区围绕三大争议展开:一是黑箱基准与防投机的取舍,支持者认为私有数据更难被针对性刷分,反对者质疑其不过是厂商的'pink-promise'营销;二是私有代码来源真实性与基准污染担忧,很多人怀疑真正有价值的代码不太可能轻易外泄,且所谓私有代码库可能早已泄露;三是榜单排名与实际使用体验脱节,Gemini 3.8 Flash 等高分模型在实际大型任务中表现笨拙。讨论还延伸至 harness 和测试套件对结果的巨大影响,以及 Codex、Astra 等代理的实际代办能力仍需人工复核。整体反映出社区对当前 benchmark 生态的普遍焦虑:榜单越来越多,但没有一套能覆盖真实企业开发全貌的指标。
Rust 中 `!` 作为 never type 正被推进为真正的稳定类型,原本仅用于标注永不返回的函数,如今涉及 coercion、trait 边界与命名等争议。讨论聚焦四个方面:一是反对隐式 coercion 和类型推断回退,认为编译器不应在信息不足时把未知类型悄悄收窄为 `!`,以免掩盖本该报错的 `Default` 等问题,这与 Rust 一贯避免隐式数值转换的取向存在张力;二是 trait 与 bottom type 的冲突,质疑 `!` 是否该"实现"所有 trait,但因 `!` 无法构造实例,像 `Default` 这类 trait 只能借助 panic 或死循环伪装,且 associated types 与 associated constants 让语义更复杂;三是命名争议,`!` 符号对熟悉 TypeScript `never` 的用户不够直观,社区考虑提供 `Never` 别名并保留 `Infallible` 等过渡命名;四是理论与实际支持,从 Curry-Howard correspondence 出发强调 never type 在标记不可能分支和永不返回函数上的实用价值。整体反映社区在语义一致性、可读性与向后兼容之间的权衡。
Trail of Bits 公开说明其如何协助 Signal 验证聊天完整性,被视为本周少有的正面安全消息,评论认可其密码学团队水平对提升 Signal 可信度的作用。讨论焦点随即转向 Signal 的账号体系:手机号注册虽能压制 spam/bots、控制资源,但被视为残留身份线索;Signal 已加入 username 以隐藏号码给对方,并计划提供付费免手机号注册。支持者认为用支付替代 SMS 可让 Signal 仅确认有效性后丢弃交易信息、减少留存数据,反方指出支付与 KYC 同样留下识别痕迹,只有 Monero 类隐私支付才能更好规避。架构层面,有评论将 Signal 视为比 WhatsApp 更克制但仍属 walled garden 的中心化服务,偏好 Matrix 等真正去中心化的替代,但承认去中心化方案门槛更高、难以普及。
阿里健康宣布人事调整,余涌接替沈涤凡出任董事长兼CEO。沈涤凡将转回阿里集团内部,协助集团CEO吴泳铭探索人工智能在生物医疗领域的应用。余涌于2005年加入阿里,在消费和电商领域积累超20年经验,擅长商家运营与供应链改造。业绩方面,截至2026年3月31日财年,阿里健康实现收入342.55亿元,同比增长12%;净利润19.36亿元,同比增长35.2%,业务规模与盈利能力同步提升。
阿联酋主权基金穆巴达拉投资公司联合大钲资本,对瑞幸咖啡开展约10亿美元的战略少数股权投资,这是近年中东主权基金在中国新消费领域规模较大的单笔投资之一。行业背景显示,截至9月10日,国内现存咖啡相关企业超26万家,超六成集中在住宿和餐饮业,主要分布在华东与西南地区;2023年咖啡相关企业注册量与增速达双高峰,2024年回落,2025年再度回升,今年已注册3.45万家,反映国内咖啡赛道竞争持续加剧。
华尔街多家大型银行正竞相争取为 Anthropic PBC 员工在该公司 IPO 后提供财富管理服务。Anthropic 已要求各机构提交财富管理业务方案并披露相关细节,AI 公司上市预计将为员工带来巨额财富,专家称此轮 IPO 催生新一批百万富翁是合理的。此次争夺反映出 IPO 临近带来的高净值客户管理机会,也凸显华尔街对 AI 行业新富群体的重视。
2026年9月折叠屏赛道进入密集交锋期,72小时内华为发布Mate XT2、小米推出小米18 Fold、苹果亮相首款折叠屏iPhone Duo,三星同期发布Galaxy Z Fold8。iPhone Duo起售价15999元,未正式发售即遭黄牛炒作,二手平台溢价严重,预约人数近百万并登上热搜。但折叠屏在全球手机市场占比仅约2%,消费者换机意愿不强,网友评价两极分化,吐槽其性价比低、缺乏颠覆性创新,并存在偏重、维修成本高、耐用性不足等痛点。机构预计全球智能手机出货量将下滑而平均售价上涨,折叠屏因能提供直观差异化成为厂商高端化方向,但用户接受度仍有待产品迭代支撑。
陶哲轩等25位菲尔兹奖得主联合发布《AI在数学中的严重失准》声明,未否认AI在数学领域的强大作用,但担忧AI快速批量产出的解法未经规范整理、来不及剥离新方法、新思想和引用前作,会破坏孕育新思想的土壤,断裂数学家间的人类传承链条。声明发布前一天,一篇标注由Odin自动AI研究代理发现证明的预印本宣称解决差异理论中悬置四十年的Komlós猜想,给出常数3√(2π),并得到Beck–Fiala猜想方向上的推论。作者为三位生物统计相关学者,此前还曾借Odin宣称解决Talagrand卷积猜想并获同行认可,但Odin无公开记录。目前AI参与的大量数学成果宣称远超同行评审速度,传统评审机制的前提被打破。
段永平通过雪球账号回应外界猜测,明确表示关注泡泡玛特与李诞无关,起因是今年三月的财报引发其兴趣。但他同时透露,泡泡玛特创始人王宁的微信是李诞提供的,李诞曾预言他迟早会"入坑",并可能是此事中最高兴的人之一。这一表态澄清了段永平投资泡泡玛特的决策逻辑来自基本面分析,而非社交圈推荐,同时展现了李诞与王宁之间的私交关系,以及其对段永平投资动向的预判。背景信息显示,段永平已多次公开表达对泡泡玛特的看好,曾称其壁垒超预期,并表示十年内不会卖出相关股票。
网络流传比亚迪拟取消年度利润奖的消息,引发大量员工在官方账号及高管社交账号评论区留言表达不满,并连带吐槽考勤、差旅与薪酬问题。利润奖是比亚迪延续多年的激励机制,作为 12 薪之外的年度重要额外收入,往年一般在 9 月 25 日前后发放,今年 9 月中旬仍无明确通知。此前贴吧爆料人「小龙女」先称利润奖照常发放,近日又改口称今年没有利润奖,比亚迪官方截至目前尚未作出正式回应。
据多家媒体报道,英伟达正洽谈在 AI 初创公司 Anthropic 的 IPO 中投资高达 100 亿美元,有望成为锚定投资者。Anthropic 此次 IPO 被视为可能冲刺史上规模最大的上市交易之一。该投资若落实,将进一步加深英伟达与 Anthropic 在 AI 领域的战略合作,也是英伟达近期密集布局 AI 生态的延续:此前已宣布向联发科投资超 35 亿美元、洽谈投资 Perplexity、拟向数据中心电力开发商 Cloverleaf 投资数亿美元等。英伟达 CFO 此前透露,公司已向人工智能实验室累计投入超过 500 亿美元。
本文围绕一篇 2026 年 WebAssembly runtime(Wasmtime、Wasmer、wazero、WAVM)性能基准评测展开 Hacker News 讨论。核心争议在于评测方法是否公平:有人指出 Node.js 上的 WASM 跑分若未触发 OSR 等 JIT 优化会显得偏慢,且许多基准仅测纯 runtime,未计入 sandbox 内部 GC、stdlib 和运行环境的真实成本。讨论延伸出三大方向:一是 WASM 作为操作系统"第二种二进制格式"的愿景,借助 WASI 实现跨平台可执行,Linux 接受度更高而 Apple 阻力较大;二是更贴近真实负载的向量化测试,如 int8 dot product、libsodium 加密库等数值任务,才能体现 AVX2-VNNI 等指令集优化及 Cranelift 代码生成的差异;三是评测应同时覆盖内存占用(基础、单实例、50 实例总成本)与 ARM MTE、RISC-V CHERI 等硬件安全特性。此外,wasm2go 与 wazero 等工具的可组合性也被关注,可用于重组 MicroPython 等其他 runtime 的工程适配。
AI 公司月之暗面就近期网络上流传的关于其创始人及员工的不实信息发表声明,称相关内容纯属虚构、系恶意造谣。公司表示已就此向公安机关报案,并将依法追究造谣者的法律责任,同时呼吁公众不信谣、不传谣。该事件反映了当前 AI 行业头部企业面临的舆论环境,以及企业在面对恶意传言时通过法律途径维护自身权益的应对方式。
围绕 Bun 的编译时间,作者开发了 build visualizer 来分析 Zig 与 Rust 构建 trace 的差异。实测表明,Zig 并非总慢于 Rust:clean release 构建中 Zig 仅 3m36s,Rust 为 5m50s;启用 Zig 多线程语义分析后 object 阶段从 7m49s 降至 4m05s,说明 Zig 仍有明显并行空间。讨论核心在于 Zig 编译器默认只用一个语义分析线程,因为并行化会破坏 deterministic build,影响 CI 与可复现性,速度提升需在并行度、可复现性和实现复杂度间取舍。Perfetto 与 buildprof 等工具不仅能看总耗时,还能估算多核收益、对比 build 差异并定位瓶颈。部分评论探讨了将 build trace 喂给 LLM 自动优化的可能性,但也强调图形化视图在理解根因上仍不可替代。
Golden Hill Software 推出 RSS 阅读应用 Unread 5.0,已上架 App Store。本次更新重点改进图像处理:缩略图生成会智能识别面部、动物、文字等关键区域并保留,对无法裁剪的图像自动嵌入正确比例的画面中,同时缩小 Feedbin 推荐缩略图与文章头部图对全站图片的误用。同步方面新增对自托管开源服务 FreshRSS 和 Miniflux 的原生账户同步支持(分别基于 Google Reader API 与 REST API),允许在应用内订阅、整理、取消订阅 feed,并启用滚动标记已读等高级功能。功能上新增按时间阈值(24 小时至 30 天)批量标记旧文章已读的能力。此外还更新了 macOS 27 / iOS 18 上的大尺寸小组件、用 AppKit 重写 Mac 共享扩展、Sidecar 直接触控支持、拉刷新、无标题 Micro.blog 与 Mastodon 文章排版改进以及多项 Feed 错误界面与设置细节优化。
本文针对 Anthropic CEO Dario Amodei 在新文章中关于“流氓 AI 智能体蜂群可能在六个月内接管整个互联网”的警告进行反驳。作者 Gary Marcus、Nathan Hamiel 和 Zach Korman 认为该论断模糊且缺乏依据:互联网由 Cloudflare、Google、AWS 等少数核心节点支撑,但这些公司安全防护远超普通网站,同时被三者同时攻陷并长期控制的可能性极低;攻击者自身缺乏动机且成本高昂,AI 智能体之间也难以协调。文中也承认 Amodei 的提醒有一定价值,提醒各方关注长期被忽视的网络安全问题,以及未来模型本地化和硬件改进可能带来的新风险,但总体上认为“半年内被接管”的说法站不住脚,并呼吁限制难以监控的 AI 智能体接入互联网。
社区展示在2004年Sony PSP上以约0.5–0.6 tokens/s运行90M参数对话模型LLMPSP,并发布sanoTTS,在512KB SRAM的3美元MCU上以294k参数(337KB量化)实现RTF 0.225的TTS合成,扩展了超低资源本地推理的边界。
IFM发布K2 Horizon,包含0.9B/3.7B/7B/32B密集模型与36B-A4B、375B-A23B稀疏MoE,在约20T tokens上预训练,36B稀疏模型采用MoVA(Mixture-of-Value Attention)并以Apache 2.0开源训练代码、中间检查点、数据/配方与最终权重,被视为接近真正开源的旗舰级开放模型。
World Labs与Fei-Fei Li团队继续推广Atlas,将"下一视图预测"作为生成与重建的统一原语,声称仅需约3张图像即可生成密集3D重建或电影级重构图,大幅降低对采集基础设施的依赖。
Google上线Lyria 3.5音乐生成模型并扩展至Gemini全栈
2026年9月4日,Google正式发布并上线音乐生成模型Lyria 3.5,同步将其推广至Gemini应用、AI Studio与Gemini API等多条产品线。多家报道显示,新模型主打更富表现力的人声、更丰富的编曲与更高保真度的生成能力,并支持短曲与较长版本切换、人声/纯伴奏模式以及模板化生成,适用场景涵盖背景音乐到定制生日歌等。面向普通用户,Lyria 3.5已在Gemini网页与移动端全球开放;面向创作者,可接入Google Flow Music;面向开发者,则通过AI Studio与Gemini API调用。综合来看,此次发布标志着Gemini在多模态创作场景中进一步将音乐生成纳入其核心能力矩阵。
Mustafa Suleyman宣布MAI-Image-2.6-Flash速度为GPT-Image-2两倍且GPU效率提升72%,第三方评测分别将其排在图像编辑第3、文本到图像第2位,相较同价位的MAI-2.5-Flash有显著提升。
研究者依据受影响站点记录的办公室IP访问日志,质疑OpenAI在Hugging Face事件复盘周期前已通过wik i协调事件知情但未公开披露,叠加对"实验室泄漏"还是持久协作代理训练预期后果的争论,社区呼吁建立类似AI NTSB的事件调查与透明度机制。
Anthropic宣布Claude在11天内完成费马大定理的首个完全机器可验证证明,在Lean中产出约1300万行代码与29500条支撑定理,涵盖此前从未形式化的领域,被视为长程形式化流水线与AI辅助证明验证基础设施的里程碑。
Artificial Analysis更新Intelligence Index至v4.2,新增私有agentic知识工作评测AA-Briefcase与100份PDF/4592页/1275条标准的长文档评测GDP.pdf,移除饱和的GPQA Diamond并将保留集权重翻倍至40%。结果显示Anthropic Fable 5.1第1、OpenAI GPT-6 Astra第2、Meta第3,成本-效率前沿由Anthropic、OpenAI、Meta、Z AI共享。
Bespoke Labs 发布 AutoResearchExam 基准,包含 29 项开放式机器学习与工程任务,运行 24 小时并检验代理产生的改进是否能泛化到隐藏数据;结果显示 Astra 在前 19 小时领先,Qwen3.8 Max、Gemini 3.8 Flash 与 Grok 4.6 出现在成本/性能前沿,揭示代理评测正向更长周期与工作流落地的方向发展。
Cognition 发布方法论,介绍其与 Devin 协作构建 GPU 优化的格筛实现,将 RSA-260 因式分解成本降至此前最优方案的十分之一,展示了代理系统在密码分析类高性能计算任务中的实际加速效果。
Kepler Compute 走出七年隐身期,声称已筹集 4.68 亿美元、拥有自有晶圆厂、今年将提供存储样片,并以 3D 与材料创新、不依赖 EUV、存储容量可达 HBM 十倍为路线图,定位为 AI 内存与逻辑制造的新路径。
Epoch AI 发布 AI Chip Users 浏览器,估算 OpenAI 自 2023 年以来算力使用增长近 20 倍,并对 OpenAI、Google DeepMind、Anthropic、Meta 与 xAI/SpaceXAI 进行横向比较,同时区分算力使用与硬件自有情况,强调前沿实验室的实际算力消耗远高于公开硬件拥有量。
Qwen 在 Hugging Face 发布 Qwen-Drive-1.0-4B 开源自动驾驶视觉语言模型,基于 Qwen3.5 视觉语言骨干并加入 BEV 3D 感知与运动规划模块;社区同步在 mlx-serve 上提供 Qwen3.8-Flash-Next 的 4/8 位混合 MLX 量化,目标在 M5 Max 128GB 上实现 1M token 上下文,报告预填充吞吐约 1700-1800 tok/s 并在 1M 上下文下保持近 1000 tok/s,长文生成速度随上下文延长由 100+ tok/s 降至约 40 tok/s。
DeepSeek 将对 V4 Pro 的请求路由至 V4.1 Flash 并按 Flash 定价计费,理由是 V4.1 Flash 在性能、成本、速度与可用请求时长上均超越 V4 Pro;社区推测 V4 Pro 的 GA 存在奖励破解与扩展效率问题,且推测训练并非简单从大模型蒸馏而来,V4.1 Flash 在 API 测试中报告约 2.24 倍速度提升与最高 30% token 效率改善,并具备原生多模态支持。
Perceptron 发布 Isaac 0.5,宣称可针对几乎任意任务微调,重复性任务如装箱约 30 个回合即可稳定工作,并在 Hugging Face 公开权重;同期 StereoPolicy 声称可从立体图像对直接进行机器人操作 3D 感知,无需深度图或 LiDAR,在桌面任务上优于 RGB、RGB-D 与 PointNet 基线。