内容
声明:完全使用AI生成,可能存在错误,需谨慎甄别。
摘要
2026-06-28 AI 领域多线并进:DeepSeek 联合北大开源 DSpark 推理框架,生成速度提升 60%–85%;苹果 Vision Pro 副总裁保罗·米德转投 OpenAI 硬件;美光市值破 1.27 万亿美元,被称「下一个英伟达」。奥地利 游说欧盟接纳 Anthropic,应对美国出口管制。AWS 预览 FinOps Agent,微软 开源 Data Formulator 0.7;IP Crawl 公网摄像头索引引隐私争议;英伟达 联合剑桥发布「红皇后哥德尔机器」,代码生成通过率提升至 71.7%。
热点事件
DeepSeek V4 推出 DSpark 推理加速框架,速度提升 60–85%
DeepSeek 联合北京大学于 6 月 27 日开源 DSpark 框架及配套代码库 DeepSpec。该框架基于推测性解码思路,将并行草稿模型与轻量串行验证结合,采用半自回归生成架构,已部署到 DeepSeek-V4 Flash 和 Pro 线上流量。官方数据显示,V4-Flash 单用户生成速度提升 60% 至 85%,V4-Pro 提升 57% 至 78%;在 80 token/s/user 目标下系统总吞吐提升 51%,更严格 120 token/s/user 目标下名义吞吐优势达 661%。DSpark 在 Qwen3 系列和 Gemma4 模型上相比代表性方案,宏平均接受长度提升 16% 至 30%,重点是工程落地而非模型能力本身迭代。
重点: DeepSeek 把生产级推测解码方法完整开源
来源:展开 5 条收起 5 条
- DeepSeek V4更新DSpark,推理速度提升80%(极客公园)
- 梁文锋署名的DSpark,看懂这10个点就够了!(量子位)
- DeepSeeK 突然发布 DSpark,让 AI 的回答不再「挤牙膏」(爱范儿)
- 算力提速关键突破:北大与 DeepSeek 联合开源大模型推理框架 DSpark(AI新闻资讯)
- DeepSeek 与北大联合开源 DSpark:高并发推理速度提升 60% 至 85%(Readhub - 每日早报)
苹果 Vision Pro 副总裁保罗·米德转投 OpenAI 硬件部门
据彭博社 6 月 27 日报道,负责苹果 Vision Pro 头显及智能眼镜项目的硬件工程副总裁保罗·米德即将离职,下周加入 OpenAI 硬件部门,参与 AI 设备研发,弗莱彻·罗斯科夫将接手其工作。此次变动被视为约翰·特努斯接任 CEO 后硬件工程团队重组的连锁反应,部分副总裁感到被边缘化。OpenAI 已吸纳多名前苹果员工,包括首席设计官乔尼·艾维、唐·坦、埃文斯·汉基等,持续推进比 iPhone「更平静」的 AI 设备项目。Vision Pro 因售价高昂市场表现不佳,苹果希望更亲民的智能眼镜能在与 Meta 可穿戴设备的竞争中扳回一城。
重点: 苹果硬件高管持续流向 OpenAI 硬件团队
来源:展开 2 条收起 2 条
- 苹果Vision Pro高管保罗·米德离职,加盟OpenAI硬件部门(极客公园)
- 苹果Vision Pro高管据报将离职并加入OpenAI(TechCrunch)
美光市值一度突破 1.27 万亿美元,被视为「下一个英伟达」
美光科技因 AI 驱动的系统性内存短缺市值飙升,本月一度超越 Meta 和特斯拉达约 1.27 万亿美元,股价过去一个月上涨超 236%,周五收于每股 1,132 美元。公司第三财季营收同比激增四倍至 414.5 亿美元,利润从 18.8 亿美元飙升至 282 亿美元,预计第四财季营收将达 490 亿至 510 亿美元。美光已与英伟达、Anthropic 等签署 16 项长期战略供应协议,提升收入可见性。同期美光首席商务官苏米特·萨达纳公开批评苹果在 2023 年内存市场低迷时过度压价,被认为是当前供应紧张的背景之一。供应短缺预计将持续至 2027 年。
重点: AI 内存紧缺周期延长,存储厂商进入长牛
来源:展开 6 条收起 6 条
- 美光高管苏米特·萨达纳告诉蒂姆·库克停止自我伤害(Andrej Karpathy Curated RSS)
- 美光暗指苹果对内存供应短缺局面负有责任:此前以极低价囤积内存导致行业惨淡(Readhub - 每日早报)
- 美光暗指苹果对内存供应短缺局面负有责任 此前苹果以极低价囤积内存导致行业惨淡(蓝点网)
- 博主仿美光CEO吐槽苹果:芯片涨45美元,苹果向消费者加价250美元(极客公园)
- 华尔街为何认为美国存储芯片制造商美光是下一个英伟达(TechCrunch)
- 美光 CEO 吐槽苹果定价模式:芯片采购价涨 45 美元,向消费者加价 250 美元(Readhub - 每日早报)
奥地利游说欧盟接纳 Anthropic,应对美国前沿 AI 出口管制
奥地利正游说欧盟接纳美国 AI 公司 Anthropic,以应对美国对前沿 AI 访问与使用的限制。讨论指出,即便硬件在欧洲,若模型、技术来源或许可链条仍受美国管辖,限制可能不会消失;欧盟的 GDPR 与 AI Act 被视为规则更可预测,但合规边界仍存摩擦。留在美国则面临市场依赖与政治报复风险,地理搬迁也难以抹去训练数据与知识产权诉讼风险。这是 Mythos 5 等前沿模型被纳入出口管制后,首个欧洲国家公开寻求替代路径的信号,反映前沿 AI 的「主权化」博弈正在加速。
重点: 前沿模型访问开始向「主权化」分流
来源:展开 1 条收起 1 条
- 🤨 奥地利游说 EU 接纳 Anthropic:监管、出口管制与诉讼争议(News Hacker | 极客洞察)
变更与实践
AWS 预览 FinOps Agent,自动调查云成本异常
AWS 在美东区域开放 FinOps Agent 公开预览,基于 Amazon Bedrock 构建。该服务可自动调查 AWS Cost Anomaly Detection 触发的成本异常,关联 CloudTrail 事件识别可能的责任方,并将汇总报告推送至 Jira 或 Slack。同时支持自然语言查询成本与用量数据,按计划生成 HTML/PDF/PPT 定期报告,并把 Cost Optimization Hub 与 Compute Optimizer 的建议汇总为 Jira 工单。预览期免费但有月度用量限制,正式定价尚未公布。
来源:展开 1 条收起 1 条
微软研究院开源 Data Formulator 0.7,强化企业数据分析
微软研究院发布开源 AI 数据分析系统 Data Formulator 0.7,面向碎片化的企业数据工作流。核心 Data Connectors 支持跨数据库、数据仓库、BI 系统、对象存储和本地文件的受治理连接。系统提供上下文感知代理,可访问数据源、已加载表格、历史图表和用户目标,完成数据检查、代码运行、图表生成与解释。Data Thread 结构化记录每个问题与中间发现,支持长会话回溯、分支与对比,交互画布允许用户直接编辑可视化或通过自然语言调整。
来源:展开 1 条收起 1 条
- Data Formulator 0.7:面向企业数据的 AI 驱动数据分析(Microsoft Research Blog - Microsoft Research)
阿里千问输入法 macOS 版上线,AI 润色支持 300 字/分
6 月 27 日,阿里旗下千问输入法 macOS 版正式上线官网,号称「说完即成稿」,支持最快 300 字/分语音输入与 AI 自动润色,覆盖 9 种方言,纯净无广告。该产品为独立 App,AI 功能和键盘更贴合手机端操作,官方预告 iOS、Android、Windows 版将于近日发布,填补千问在移动端 AI 输入法赛道的空白。
来源:展开 1 条收起 1 条
安全与风险
IP Crawl 公网摄像头活地图引发隐私与基础设施担忧
IP Crawl 是一个抓取并索引公网可访问摄像头的网站,将零散实时视频流汇总成可搜索的「活地图」。该站点暴露了长期存在的设备误配置问题:许多家用 IP 摄像头、商用监控甚至 SCADA 和 HMI 等工业控制设备被直接挂在公网,自 2012 年以来几乎未改善。实时画面可能包含卧室、餐桌等私人空间,并可识别出英国 Droitwich 等具体地点。零散画面还容易与现实事件关联,引发对基础设施风险和个人隐私边界的担忧。
影响: 家用摄像头、商用监控、工业控制设备使用者与附近居民
建议: 设备应默认拒绝公网访问,使用 VPN 或独立网段隔离
来源:展开 2 条收起 2 条
- 😬 IP Crawl:公网开放摄像头活地图与隐私争议(News Hacker | 极客洞察)
- IP Crawl – 发现你身边的公共摄像头?(小众软件)
Meta 调用 Google Gemini 遇配额上限,前沿模型访问呈分层化
Meta 调用 Google Gemini 时遇到容量或配额上限,而非 Google 主动限制其功能。前沿模型访问可能分层化,企业优先获得高配额,个人用户可能面临降级或受限,地区限制和 KYC 审查也将成为准入门槛。Llama 在 OpenRouter 热度走低、Spark Muse 仅限自家产品,反映其外部模型生态走弱,用户开始从 Gemini、Claude Code 转向 DeepSeek v4 Pro/Flash 等低成本方案。
影响: 依赖第三方大模型 API 的企业开发者与中小客户
建议: 提前规划配额与多供应商备份,关注区域与合规限制
来源:展开 1 条收起 1 条
- 🤨 Google 因算力配额限 Meta 用 Gemini,Llama 热度走低(News Hacker | 极客洞察)
开源与工具
ai-website-cloner-template:一行命令像素级克隆任意网站
GitHub 开源项目 ai-website-cloner-template 获 2 万 Star,可通过 /clone-website 加目标 URL 在 Claude Code 等 AI 编程工具中完成全站逆向解析,包括采集元素样式、遍历交互逻辑、提取设计 Token,并调度多 Agent 并行重建组件,最终输出可本地运行的完整 Next.js 工程。项目支持 Claude Code、Codex CLI、Cursor、Copilot、Gemini CLI、Windsurf 等多种 AI 编程工具,但无法捕获私有业务 JS、登录态受限动态内容及第三方嵌入组件。
适用场景: 平台迁移、源码恢复与学习拆解,需注意版权与服务条款
来源:展开 1 条收起 1 条
browser-use/video-use:用自然语言编辑视频
browser-use/video-use 是 GitHub 上开源项目,允许用户通过 Claude Code 等编程代理来编辑视频。核心功能包括自动删除填充词与无效停顿、自动调色、30 毫秒音频淡入淡出、烧录字幕,以及通过 HyperFrames、Remotion、Manim 或 PIL 生成动画叠加层。项目采用「文本优先」架构:先通过 ElevenLabs Scribe 转录音频生成带时间戳的文本,再按需调用 timeline_view 生成视觉合成帧,避免直接处理大量视频帧。已积累 10.6k Stars 和 1.5k Forks,采用 MIT 协议。
适用场景: 创作者用对话式 AI 自动化视频剪辑与字幕
来源:展开 1 条收起 1 条
- browser-use/video-use(Trending repositories on GitHub today · GitHub)
FluidVoice 1.6.0:macOS 端离线 AI 语音转文本
FluidVoice 是一个开源的 macOS 端离线语音转文本听写应用,主打完全本地化的 AI 增强功能,采用 GPLv3 协议。1.6.0 版本重构了 Parakeet 模型实现,大幅降低语音到文字延迟;Fluid Intelligence 是完全本地的 AI 模型,用于设备端的听写后处理,包括智能格式化、上下文感知大小写等,无需云端或 API 密钥。新版本同时提供自适应明暗主题、紧凑工具栏切换与优化后的首次设置流程,并支持 Parakeet、Whisper 等多种语音模型。
适用场景: macOS 用户对隐私敏感的本地语音输入与听写
来源:展开 1 条收起 1 条
- altic-dev/FluidVoice(Trending repositories on GitHub today · GitHub)
数据与洞察
英伟达联合剑桥发布「红皇后哥德尔机器」,代码生成通过率提升至 71.7%
英伟达与剑桥大学等机构联合发布「红皇后哥德尔机器」(RQGM)论文,打破哥德尔机因需数学证明而被困 20 年的理论封印。AI 自行编写学习算法并在沙盒中试炼,幸存者繁衍并「进化」出更严苛考官。RQGM 代码生成通过率从 69.9% 升至 71.7%,token 消耗减少 1.35–1.72 倍;论文接收率从 21.8% 飙升至 40.5%;奥赛级数学证明评分更准确,搜索成本降至 1/3,并解决 LLM 裁判偏爱 AI 内容的问题。
数据: 代码通过率 +1.8 pct,论文接收率 +18.7 pct,搜索成本降至 1/3
意义: AI 自主进化机制向工程级代码与论文写作落地
来源:展开 1 条收起 1 条
AI 芯片利用率不足 10%,数据饥饿与内存带宽成新瓶颈
Epoch AI 估算 2025 年底 OpenAI 等效算力达 170 万块 H100,两年暴增 17 倍,但前沿实验室 GPU 利用率可能不足 10%。Fujitsu 报告显示超过 75% 的企业在峰值负载下 GPU 利用率仍低于 70%,VentureBeat 判断约 95% 的 AI 基础设施开支被浪费。核心瓶颈在于数据饥饿:GPU 有 30% 至 65% 的时间因数据未准备好而闲置,最佳实践者 MFU 可达 60% 至 70%,若将利用率从 10% 提升至 60%,等同有效算力扩大 6 倍。
数据: GPU 利用率 <10%,75% 企业峰值 <70%,数据等待占 GPU 时间 30-65%
意义: 算力规模红利见顶,数据与内存带宽优化成为下一阶段竞争力
来源:展开 1 条收起 1 条
趋势观察
前沿 AI 的「主权化」博弈与算力效率优化正成为下一阶段主线。一方面,前沿模型访问被纳入出口管制与企业配额管理,奥地利等国开始寻求替代路径;另一方面,GPU 利用率不足 10% 的数据揭示数据饥饿与内存带宽正在取代算力规模成为新的竞争焦点。DeepSeek DSpark 等推理优化开源,意味着效率竞赛将向生产级工程扩散,开发者与企业需要重新评估「算力 vs 数据 vs 内存带宽」的资源配置优先级。