2026-07-30

从 41 条内容中筛选出 15 条重要资讯。

GitHub Stacked PRs 现已公开预览

github.blog · ⭐️ 9/10 · 2026-07-30

9/10

GitHub 已推出 Stacked PRs 公开预览版,让开发者能够将大型变更拆分为小型、可审查的拉取请求,并以堆栈形式组织。 这是 GitHub 工作流程的重大变革,支持增量开发和审查,可提升代码质量和开发者效率。它让更多开发者接触到堆栈式工作流,有望改变大型功能的上线方式。 Stacked PRs 是一系列有序的拉取请求,每个代表变更的一个聚焦层,支持 CLI \(gh-stack\) 和 UI。但用户反馈合并整个堆栈存在漏洞,且在需要审查时使用 squash-and-merge 需重新批准。

OpenAI GPT-5.6 Luna 降价 80%

openai.com · ⭐️ 9/10 · 2026-07-30

9/10

OpenAI 宣布将其最快最便宜的模型 GPT-5.6 Luna 降价 80%,同时通过内核优化和实验提升 15%的效率。 这一大幅降价重塑了 AI 模型的经济性,使高质量推理成本仅为以前的一小部分,并标志着在一年涨价后进入了价格下降的新阶段。 降价 80%意味着 Luna 现在便宜了 5 倍,这是通过内核工作将服务成本降低 20%以及 token 生成效率提升 15%以上实现的。此举适用于 API 和消费者使用。

9/10

月之暗面科技(Moonshot AI)发布了 Kimi K3,这是一个开源权重的大语言模型,在 580 个模型中排名第四,仅次于 Claude Opus 5、Fable 5 和 GPT-5.6 Sol。它引入了三项关键创新:Kimi Delta Attention(用每个头 128×128 的矩阵替代 KV 缓存)、Quantile Balancing(用于平衡每层 896 个专家的负载)以及 AgentENV(一个用于强化学习训练的 Firecracker 微虚拟机运行时)。 Kimi K3 证明了开源权重模型能够与最好的专有前沿模型竞争,可能加速 AI 研究和部署。其架构创新——尤其是内存高效的注意力机制和无超参数的负载均衡——可能会影响整个行业的未来模型设计。 Kimi K3 在 93 层中的 69 层使用了 Kimi Delta Attention,将 100 万 token 上下文的显存占用从 104.6 GiB 降低到 27.2 GiB。Quantile Balancing 直接从单次批次的路由器分数边距计算偏置,避免了 DeepSeek-V3 使用的固定步长偏置调整。AgentENV 在 RL 训练期间创建了 5100 万个沙箱,检查点耗时 133 毫秒,恢复耗时 49 毫秒。

9/10

Anthropic 的 Claude Mythos Preview 模型发现 NIST 后量子数字签名算法 HAWK 的严重弱点,将其有效密钥强度减半。攻击耗时约 60 小时,耗费 10 万美元 API 费用,而人类专家此前两年未能发现。 这表明 AI 在发现后量子密码候选算法漏洞方面可超越人类密码分析员,可能重塑 NIST 标准化进程。它强调了密码敏捷性的必要性,以及应依赖经证明的标准而非等待完美算法。 该攻击针对 HAWK-256,将其安全性从 2^64 降至 2^38 次操作,但攻击并非多项式时间,因此更大密钥仍安全。此外,该模型改进了对七轮 AES-128 的最优攻击,但完整 AES-128(10 轮)不受影响。

谷歌 DeepMind 解散了曾获诺贝尔奖的 AlphaFold 蛋白质结构预测研究团队,核心成员 John Jumper、Jonas Adler 和 Alexander Pritzel 跳槽至竞争对手 Anthropic。 此举标志着 AI 研究领域人才争夺战加剧,DeepMind 将资源转向大语言模型等项目,而 Anthropic 则获得了顶尖的结构生物学人才。 AlphaFold 原论文的近四分之一作者已完全离开公司,其他成员被重新分配到 Gemini、酶设计、核聚变及 Isomorphic Labs 等项目。

Gemini Robotics 2 实现机器人全身智能

deepmind.google · ⭐️ 8/10 · 2026-07-30

8/10

2026 年 7 月 30 日,谷歌 DeepMind 发布了 Gemini Robotics 2,这是一组三个视觉-语言-动作模型,能够实现对完整人形机器人的全身智能控制、精细灵巧操作以及多机器人协作。 此次发布将机器人技术从桌面操作推进到全身协调,是迈向能够在现实环境中运行的通用人形机器人的重要一步。它展示了大模型与物理行动的结合,可能加速机器人在家庭和工作场所的部署。 Gemini Robotics 2 基于 Gemini 2.0,以三个独立模型形式发布,访问权限受限,目前仅向波士顿动力等受信任的测试者开放。这些模型将视觉和语言输入转化为电机指令,可完成行走、操作和团队协作等全身任务。

欧足联及 55 个成员协会抵制 FIFA 赛事

uefa.com · ⭐️ 8/10 · 2026-07-30

8/10

欧足联及其 55 个国家协会宣布将不参加 FIFA 赛事,理由是对治理问题和投资者影响的担忧。 这代表了国际足球治理中的重大裂痕,可能导致竞争性赛事,并重塑这项运动的全球结构。 抵制源于 FIFA 计划将世界杯扩大到 48 甚至 64 支球队,并允许外部投资者获得赛事所有权。

缪子谜题破解,旧结果不再吻合

quantamagazine.org · ⭐️ 8/10 · 2026-07-30

8/10

物理学家通过格点 QCD 计算使理论预测与 Fermilab 实验测量一致,解决了存在数十年的缪子 g-2 反常。但这一解决却使布鲁克海文实验的旧结果失效,现在显示出显著偏差。 这一解决加强了粒子物理标准模型——此前该模型曾因明显的反常而受到挑战。同时,它也迫使人们重新评估先前的实验结果,可能改变对基本粒子性质的理解。 关键突破来自改进的格点 QCD 计算,它降低了理论不确定性,使缪子反常磁矩(g-2)的预测值与 Fermilab 结果一致。布鲁克海文测量曾被视为新物理的先兆,如今却与理论-实验联合共识偏离 4.2 个标准差。

重构的经济效益分析

martinfowler.com · ⭐️ 8/10 · 2026-07-30

8/10

Martin Fowler 的文章定量分析了重构的经济效益,特别是在 AI 工具辅助下,通过实际测量展示了成本节约和质量改进。 该分析将 AI 辅助软件工程置于具体数据之上,超越了模糊的评论,为考虑采用 AI 的开发者和组织提供了可操作的见解。 该文章可能比较了重构前后的 token 消耗等指标,证明 AI 辅助重构可以降低成本并提高代码质量。

GCC 指导委员会宣布 AI 政策

lwn.net · ⭐️ 8/10 · 2026-07-30

8/10

GCC 指导委员会宣布了一项政策,限制 AI 生成的贡献,理由是版权和开源伦理问题。 该政策为大型开源项目处理 AI 贡献树立了先例,可能影响更广泛的自由软件生态。 该政策明确针对大语言模型的贡献,指出此类输出可能不受版权保护,这与 GPL 对版权的依赖相冲突。

教授因同行评审流程失去三位潜在博士生

reddit.com · ⭐️ 8/10 · 2026-07-30

8/10

一名早期职业助理教授报告称,由于会议评审流程让才华横溢的本科生对研究职业望而却步,他失去了三位半潜在博士生。这些学生参与撰写了评价很高但仍被拒绝的论文,陷入无尽的重新提交循环。 这凸显了机器学习学术出版中的系统性问题,即评审流程可能阻碍有才华的新人进入该领域。它强调了改革同行评审、减少随机性和偏见的必要性,因为当前体系可能正在损害研究的未来。 该教授在顶级会议上拥有超过 10 年经验,并认为这些论文远高于录取标准。其中一篇论文获得了四个一致“弱接收”但被拒绝,导致无尽重新提交,每次解决之前的问题后只会招致更多随机的批评。

字节重组 To B:飞书并入豆包和火山引擎

news.qq.com · ⭐️ 8/10 · 2026-07-30

8/10

字节跳动重组企业业务,将飞书产品团队与豆包产品团队合并,成立新的‘豆包产品团队’,由赵祺负责;飞书的市场、销售及客户服务团队与火山引擎整合,成立‘创造力服务平台’,由谭待负责。 这是字节跳动成立以来最大规模的 To B 重组,表明其将消费端 AI 领先优势(豆包拥有 3.3 亿用户)向企业生产力场景商业化的重要战略。通过将协作工具、AI 助手和云服务紧密结合,可能重塑中国企业软件和 AI 市场。 现有飞书产品和服务保持不变,双方共同开发的豆包企业版已在部分飞书客户中内测。重组后,飞书负责人谢欣在产品方面向赵祺汇报,而市场、销售和客服职能则纳入谭待领导的创造力服务平台。

美委员会代表团访华遭华为、DeepSeek 等拒见

tech.ifeng.com · ⭐️ 8/10 · 2026-07-30

8/10

2026 年 7 月下旬,美国美中经济与安全审查委员会(USCC)代表团访问北京、杭州和上海,但被华为、腾讯、阿里巴巴、百度和 DeepSeek 等中国头部科技企业集体拒绝会面或实地考察。 此次拒绝凸显了中美科技领域日益紧张的局势和不信任,可能影响未来关于 AI 和半导体的政策建议及出口管制。它突显了在关键技术上双边接触日益困难。 USCC 成立于 2000 年,是一个独立的立法机构委员会,历史上一直推动对华芯片制裁、扩大实体清单和 AI 技术出口限制。这是其自 2019 年以来首次正式访华。

澳大利亚 eSafety 专员办公室对 Telegram 提起法律诉讼,指控其未按要求删除宣扬恐怖主义的内容,包括基督城和布法罗恐袭视频,最高可能面临 5460 万澳元的民事罚款。 此案凸显了加密消息平台在内容审核方面面临的日益增长的监管压力,可能为各国政府追究科技公司对用户生成极端内容的责任树立先例。 法院文件显示,2025 年 7 月至 10 月间,澳大利亚用户曾就 12 条涉恐帖文投诉,但 Telegram 未删除其中 10 条,也未封禁相关账号。

欧盟委员会正式启动最多七座 AI 超级工厂的招标,旨在撬动约 3000 亿欧元投资,其中 1000 亿欧元来自欧盟层面资金和参与成员国。 此举标志着欧盟为打造自主 AI 基础设施、与美国和中国等全球领先者竞争的战略性举措,可能重塑欧洲科技生态系统并吸引大量私人资本。 招标支持最多七座 AI 设施,分为选址和扩建两个阶段。投标截止日期为 2024 年 11 月 12 日,中标结果预计 2027 年 7 月公布,设施必须在签约后 18 个月内投入运营。