内容
声明:完全使用AI生成,可能存在错误,需谨慎甄别。
摘要
2026-07-06 AI领域呈现多线并进格局,值得关注的信息:腾讯混元Hy3正式发布并开源,MoE架构总参数295B激活21B;Anthropic斥资150亿美元锁定澳大利亚140万千瓦算力;SK海力士启动280亿美元ADR上市,规模仅次于上月SpaceX;Cloudflare与AWS先后将x402智能体微支付嵌入边缘网络;安全厂商披露首例AI智能体全自动勒索攻击JADEPUPPER,AI已具备自主串联漏洞利用与破坏性攻击能力。
热点事件
腾讯混元Hy3正式发布并开源
腾讯于7月6日正式发布混元Hy3大模型并开源,采用MoE架构,总参数295B、激活21B,支持256K上下文。相比Preview版智能显著提升,以较小参数比肩2—5倍规模旗舰模型,定价输入1元、输出4元/百万tokens,Apache 2.0协议开源。Hy3已接入WorkBuddy、CodeBuddy、元宝、Marvis、ima及微信公众号AI分身、微信读书、WeGame等业务,WorkBuddy任务成功率升至90%、元宝幻觉率下降过半;模型陆续上线HuggingFace、Modelscope、OpenRouter等海外平台供全球开发者免费商用。
重点: 国产旗舰MoE开源,价格击穿海外产品。
来源:展开 4 条收起 4 条
- 腾讯混元 Hy3 发布:Agent 能力和产品体验跃升(Readhub - 每日早报)
- 腾讯混元Hy3发布:Agent能力和产品体验跃升(腾讯技术工程)
- 腾讯混元Hy3发布:Agent能力和产品体验跃升(AI新闻资讯)
- 实测腾讯 Hy3 正式版,这次终于赶上了「AI 下半场」(爱范儿)
Anthropic斥资150亿美元锁定澳大利亚算力
Anthropic计划在澳大利亚采购至少140万千瓦数据中心算力资源,总投资规模约达150亿美元,远超此前市场预估。公司目标最迟于2027年底前启用至少100万千瓦算力,并在当地设立办公室推进供应链与基础设施落地。项目可能拆分为四至五份合作合同分批执行,距最终投资决定还有约六周时间。此举被视为头部AI企业在全球算力竞争白热化背景下,强化能源与基础设施掌控的关键布局,澳大利亚有望成为全球AI算力版图的新增长极。
重点: 算力主权化加速,澳成新增长极。
来源:展开 2 条收起 2 条
- Anthropic 拟收购澳大利亚数据中心算力资源(Readhub - 每日早报)
- Anthropic 开启百亿级算力豪赌,拟在澳大利亚加码千兆瓦数据中心(AI新闻资讯)
SK海力士启动约280亿美元ADR上市
芯片巨头SK海力士本周正式启动纳斯达克ADR上市计划,拟通过发行约1779万股ADR筹资约280亿美元,最终定价周四确定、周五挂牌交易。基石投资者有意认购高达70亿美元ADR,上市已获超额认购,有望成为全球史上第二大IPO,仅次于上月SpaceX的857亿美元。受AI算力需求驱动,公司作为高带宽内存核心供应商为英伟达、谷歌等科技巨头供货,今年股价累计涨约273%。本次大规模上市被视为AI产业链硬件资本注入的新阶段标志。
重点: HBM赛道吸金,规模仅次于SpaceX。
来源:展开 2 条收起 2 条
- 韩国 SK 海力士将启动 280 亿美元美国上市计划(Readhub - 每日早报)
- 巨资奔赴纳斯达克:SK海力士拟筹资 280 亿美元,剑指史上第二大IPO(AI新闻资讯)
首例AI智能体全自动勒索攻击JADEPUPPER曝光
安全厂商 Sysdig 披露了全球首例全流程由 AI 智能体 自主完成的勒索攻击,代号 JADEPUPPER。攻击者利用暴露在公网的 Langflow 服务中的已知高危漏洞 CVE-2025-3248 获取主机控制权,随后智能体自动侦察系统、搜集API密钥及数据库账号,通过默认口令访问对象存储,并以定时任务维持长期访问。攻击生产服务器时智能体展现出策略调整能力——操作失败后仅用 31 秒 完成错误分析与修正,成功夺取管理员权限,最终执行超 600 个 有逻辑载荷,将 MySQL 配置数据加密并留下比特币勒索信息。
重点: 首例AI全自主串联漏洞与破坏。
来源:展开 2 条收起 2 条
- 全球首例AI智能体勒索攻击浮出水面:无需人类干预的自动化“作案”链条(AI新闻资讯)
- 首例全自动无人工操控勒索攻击曝光(AI洞察日报 RSS Feed)
Cloudflare与AWS将x402智能体微支付嵌入边缘网络
Cloudflare与 AWS 在数周内先后将 x402 智能体支付 嵌入边缘网络,标志着智能体对服务的微支付正从概念走向基础设施。x402 协议复活了 HTTP 自 1997 年以来一直闲置的 402 "Payment Required" 状态码,由 Coinbase x402 Facilitator 完成链上验证与合规筛查,结算主要使用 Base 网络上的 USDC,单笔费用不到一美分。在 Cloudflare 的 330 多个城市节点和 AWS 的边缘节点上,付费校验在请求到达源站前完成。Coinbase 数据显示该协议首年已处理 超过 1.69 亿笔支付,涵盖 59 万买家和 10 万卖家。
重点: 智能体微支付基础设施初步成型。
来源:展开 1 条收起 1 条
变更与实践
Anthropic发布Claude Science Beta生命科学平台
Anthropic正式发布Claude Science Beta科研平台,专注生命科学研发。核心功能包括协同智能体自动运行多步实验流程,以及评审程序能够实时自动纠正论文结论。该工具旨在通过AI技术加速复杂科学研究进程,提高实验效率和准确性,将实验设计、执行与同行评审整合到统一工作流中。
来源:展开 1 条收起 1 条
- Anthropic发布Claude科学科研平台测试版(AI洞察日报 RSS Feed)
MCP企业托管授权扩展升级为稳定版
Model Context Protocol(MCP) 团队将企业托管授权(EMA)扩展提升为 稳定版,采用 Identity Assertion JWT 流程,将授权决策从单个 MCP 服务器转移至企业身份提供方。Anthropic、Microsoft、Okta 已宣布支持,Claude、Claude Code、Cowork、VS Code 已完成客户端集成,Asana、Atlassian、Figma、Linear、Supabase 等服务器端也已支持。官方明确EMA仅控制连接级授权,运行时动作仍需企业独立配置策略。
来源:展开 1 条收起 1 条
- AI 模型上下文协议为企业增加集中式身份认证(InfoQ)
Meta下线Llama API公共预览版服务
Meta宣布于2026年7月6日正式下线 Llama API 公共预览版 服务,相关 API 请求将返回停用提示并提供重定向指引。本次调整仅针对 API 服务层面,Llama 模型本身不受影响,开发者仍可通过 Meta 官方下载页面获取并使用模型。Meta 建议现有用户尽快迁移至其他支持 Llama 的第三方服务商,并透露正构建全新的开发者路径,更多新工具细节预计近期公布。
来源:展开 2 条收起 2 条
- Meta 调整 AI 开发节奏:Llama API 公共预览版将于明日下线(AI新闻资讯)
- Meta宣布下线测试版API公共预览服务(AI洞察日报 RSS Feed)
字节跳动将于7月9日发布Seedance 2.5视频模型
字节跳动据传将于7月9日正式发布其Dreamina Seedance 2.5模型,该模型预计将在 Dreamina、CapCut 等平台上线。新版本核心亮点是能够输出长达 180 秒(3分钟) 的视频,但目前在角色身份一致性、运动逻辑、镜头语言及提示词意图稳定性方面的具体表现尚不明确;CapCut 已确认集成该模型并先行支持 30 秒 AI 场景。
来源:展开 1 条收起 1 条
微软合并消费者与企业版Copilot打造AI超级应用
Microsoft宣布将消费者版和企业版 Copilot 合并,构建统一的AI 超级应用,整合不同用户群体的功能体验。其中AutoPilot 智能体预计将额外收费,与基础订阅形成分层服务,旨在应对日益激烈的 AI 产品市场竞争,并通过统一入口减少跨场景切换成本。
来源:展开 1 条收起 1 条
- 微软合并消费者与企业版 Copilot,打造 AI 超级应用(AI Breakfast)
安全与风险
微软确认Windows 11 24H2/25H2 WAL文件膨胀Bug
微软已确认 Windows 11 24H2 和 25H2 存在 Bug,导致 CapabilityAccessManager.db-wal 文件持续异常增大,最高已知占用 500GB(实测 513GB)磁盘空间。原因是 功能访问管理器 服务进入无限循环反复写入日志,并非所有用户都受影响。微软计划于 2026 年 7 月 14 日 通过累积更新修复;空间紧张的用户可在安全模式下手动删除该目录,但存在 Wi-Fi 故障和文件再次增大 的风险。
影响: Windows 11 24H2/25H2 部分用户磁盘空间被异常占用。
建议: 通过存储设置或 TreeSize 检查 WAL 文件大小,等待7月14日补丁。
来源:展开 1 条收起 1 条
日本15岁少年利用AI实施勒索致万代频道停服
日本埼玉县一名15岁高一学生因利用生成式 AI 实施网络攻击被捕。调查显示该少年于2025年11月利用他人会员账号侵入万代南梦宫旗下BANDAI CHANNEL 平台,随后编写恶意程序批量注销了46812 个会员账号,导致平台被迫全站停服,并非法获取大量受害者个人敏感信息。该少年自小学四年级起自学计算机技术,事件揭示了生成式 AI 技术降低网络攻击门槛的潜在风险。
影响: AI降低攻击门槛,未成年人也可造成规模化破坏。
建议: 企业加强默认安全配置与异常行为监测。
来源:展开 1 条收起 1 条
- 15 岁少年利用AI实施勒索攻击,致知名平台全站停服(AI新闻资讯)
美国俄亥俄州某郡政府向黑客支付100万美元封口费
2025年6月,美国俄亥俄州某郡政府向黑客组织 Kairos 支付约 100 万美元(9.44 枚比特币)封口费,原因是黑客窃取约 2TB 数据 后威胁公开。值得注意的是,黑客并未加密任何文件,仅靠泄露威胁迫使受害者付款,且所谓"删除证明"无法证明数据已被真正删除。机构 Ransom-ISAC 建议受害方不要盲目支付赎金,以免助长黑客气焰且数据仍可能被转售。
影响: 泄露型勒索亦可迫使政府机构就范,数据可能被二次利用。
建议: 不盲目支付赎金,评估数据被二次利用风险。
来源:展开 1 条收起 1 条
开源与工具
Hugging Face发布🤗 Kernels重大更新
Hugging Face 发布 🤗 Kernels 项目重大更新,Hub 新增 kernel 仓库类型。安全方面引入可信发布者机制和基于 Sigstore cosign 的代码签名。CLI 重新设计并新增 Torch Stable ABI 和 Apache TVM FFI 支持,奠定 agentic kernel 开发 基础;kernel-builder 提供可预测的项目结构和 agent 优化的 CLI,配合 HF Jobs 实现自动基准测试。
适用场景: AI智能体编写与调用GPU内核的全链路基础设施。
来源:展开 1 条收起 1 条
- 🤗 Kernels 重大更新(Hugging Face - Blog)
Hugging Face发布LeRobot v0.6.0强化机器人学习闭环
Hugging Face 发布 LeRobot v0.6.0 版本,核心主题为"想象、评估、改进"机器人学习闭环。新增三项世界模型策略(VLA-JEPA、LingBot-VA、FastWAM)和五款 VLA 模型(NVIDIA GR00T N1.7、MolmoAct2 等),数据集层面支持深度感知、VLM 自动语言标注,加载速度提升约 2 倍。推出 lerobot-eval CLI 统一管理六个新仿真基准,安装依赖减少约 40%。
适用场景: 机器人学习研究者构建端到端训练与评估流水线。
来源:展开 1 条收起 1 条
- LeRobot v0.6.0:想象、评估、改进(Hugging Face - Blog)
美团开源基于国产芯片训练的万亿级大模型
美团宣布开源其基于国产芯片训练的万亿级大模型,旨在推动国内 AI 基础设施建设,降低对特定海外硬件的依赖。具体技术细节、模型架构和训练框架尚未公开披露,但开源发布本身标志着国产 AI 算力栈在大规模模型训练领域迈出实质一步。
适用场景: 国产算力栈大模型训练验证与国产化路径参考。
来源:展开 1 条收起 1 条
- 美团开源万亿级国产芯片训练大模型(AI洞察日报 RSS Feed)
Karakeep登顶GitHub趋势,自托管LLM书签管理应用
Karakeep(原名 Hoarder)是一款自托管全能书签管理应用,目前在 GitHub 趋势上受到关注。它支持保存链接、笔记、图片与 PDF,并通过 LLM(如 ollama 本地模型)实现自动标签与摘要、全文本搜索、OCR 文字提取、全页归档(防链接失效)以及 yt-dlp 视频归档,提供 Chrome/Firefox/Safari 插件与 iOS/Android 客户端,支持 RSS 自动采集、SSO、批量操作和 floccus 书签同步。
适用场景: 隐私敏感用户替代 Pocket 的本地化智能书签工具。
来源:展开 1 条收起 1 条
- Karakeep:一款支持 LLM 自动标签与全页归档的自托管书签管理应用登顶 GitHub 趋势(Trending repositories on GitHub today · GitHub)
数据与洞察
阿里清华JustGRPO方案入选ICML 2026杰出论文
阿里巴巴与清华大学合作的论文《灵活性陷阱:重新审视扩散语言模型中任意顺序生成的价值》入选 ICML 2026 杰出论文。论文发现扩散大语言模型的任意顺序生成能力在推理任务中反成陷阱——模型会绕过高不确定性关键节点,导致推理路径被锁死。基于此,团队提出极简方案 JustGRPO,在 GSM8K 上达到 89.1% 准确率,超越所有为扩散模型专门设计的复杂算法。
数据: JustGRPO 在 GSM8K 准确率 89.1%,超过 d1、ESPO、SPG、GDPO。
意义: 扩散模型推理未必需要复杂设计,简单回归从左到右更有效。
来源:展开 1 条收起 1 条
哈佛MIT谷歌等联合发布MemoBench世界模型评测基准
哈佛、MIT、谷歌等机构联合发布世界模型评测基准 MemoBench,已被 ECCV 2026 接收。该基准基于"可见-消失-重现"三段式范式,通过 360 段高质量真值视频系统性测试物体离开视野后模型能否维持状态记忆并正确还原这一核心能力。评测 10 个主流世界生成模型后发现:所有模型物体重现得分均未超过 0.6,记忆连续性语义得分最高仅 55.6 分,表明生成画面逼真与真正维护世界状态之间存在显著差距。
数据: 360段视频、10个主流世界模型,重现得分均低于0.6。
意义: 世界模型评估从视觉生成走向状态记忆,揭示新诊断维度。
来源:展开 1 条收起 1 条
- 世界模型评测的最大盲区,被这个新基准捅破了(机器之心)
哈佛研究:AI原生企业更青睐资深员工
哈佛商学院与 INSEAD 联合研究指出,AI 原生初创企业正在系统性减少对初级员工的招聘。数据显示,AI 原生企业团队规模比非 AI 原生企业小 25%,工程师占比高出约 13%,而初级员工和管理人员比例分别低约 15%。资深员工比例反而高出约 20%,AI 并未消灭高端岗位,反而放大了对深度经验和判断力的需求,形成"专家溢价"现象。
数据: AI原生企业团队规模小25%,资深员工比例高20%。
意义: AI替代初级执行,但强化对深度经验与判断力的需求。
来源:展开 1 条收起 1 条
快手中科院软件所MetaphorVU入选ICML 2026 Spotlight
快手联合中科院软件所、清华的论文《MetaphorVU》获 ICML 2026 Spotlight,提出业界首个隐喻视频理解系统性框架。团队构建覆盖 8 类隐喻、860 条视频的基准 MetaphorVU-Bench,评测 11 个主流多模态大模型:即便 Gemini-3-Pro、GPT-5 平均仅约 64 分,与人类 83.4 分差距近 20 分。据此提出基于首个隐喻知识图谱的推理时增强框架 MetaphorBoost,无需重训即可在多类模型上稳定提升 2-7 分。
数据: MetaphorVU-Bench 含8类隐喻860视频,主流模型最高仅64分。
意义: 多模态评估从感知层推向认知层,揭示隐喻理解短板。
来源:展开 1 条收起 1 条
其他值得看
折叠屏iPhone推迟至Q4发售
郭明錤称折叠iPhone推迟至Q4发售。
来源:展开 1 条收起 1 条
- 曝折叠屏iPhone发售将推迟至第四季度(爱范儿)
华为更新韬定律论文V2版
华为更新韬定律V2,放弃顺序3D集成。
来源:展开 2 条收起 2 条
- 华为发布“韬定律”V2版论文提出时间缩微新理论(AI洞察日报 RSS Feed)
- 华为更新韬定律论文!(量子位)
WhatsApp开放用户名预约
WhatsApp开放用户名预约,印度警告冒名风险。
来源:展开 5 条收起 5 条
- Meta 开放 WhatsApp 用户名预留功能(少数派)
- WhatsApp 用户名功能已引发冒名顶替风险警示(TechCrunch)
- WhatsApp 现已支持用户名预留(TechCrunch)
- 如何预留和更改你的 WhatsApp 用户名(TechCrunch)
- WhatsApp 现已开放用户名预约(TechCrunch)
联想控股牵头成立产学研工作委员会
联想控股牵头成立中文信息产学研工作委员会。
来源:展开 1 条收起 1 条
千亿航天发布阿赖耶识星座
千亿航天发布阿赖耶识星座,部署12500颗算力卫星。
来源:展开 1 条收起 1 条
英伟达推出Horizon自动化芯片设计框架
英伟达推出Horizon自动化芯片设计框架。
来源:展开 1 条收起 1 条
- 英伟达推出自动化芯片设计新框架(AI洞察日报 RSS Feed)
Agility Robotics将通过SPAC上市
Agility Robotics将SPAC上市,估值25亿美元。
来源:展开 1 条收起 1 条
- 这家人形机器人公司将上市,但其CEO并未承诺机器人很快进入家庭(TechCrunch)
晚点发布26Q2 AI季报
晚点发布26Q2 AI季报,编码代理战争升级。
来源:展开 1 条收起 1 条
- AI 季报 26Q2:从 coding 到 RSI,强者愈强的未来?(晚点 - 最新报道)