arXiv cs.AI 周报 (2026-07-20~2026-07-26)
🗓️ 本周覆盖
本周(2026-07-20 ~ 2026-07-26)共 4/7 天 daily 报告可用,累计覆盖约 453 篇 cs.AI 论文。
缺失日期:2026-07-24、2026-07-25、2026-07-26(这些日的论文不在本汇总范围内)。
下文所有数字和取舍都基于这 4 天的 daily picks。
🔥 本周主题
🧠 推理可控性与效率革命(4/4 天出现)
本周最强主题。研究重心从"让模型思考更久"全面转向"精确控制模型如何思考"——激活空间干预、冗余验证剪枝、异构认知集成、隐式推理 RL、RLVR 机制剖析构成完整技术栈。4 天中每天至少 5 篇直接涉及推理优化或 RL 训练机制。
🤖 智能体:从"能做"到"可靠地做"(4/4 天出现)
智能体研究本周全面转向工程化与可靠性:记忆生命周期管理、调试归因、预算感知路由、递归自改进、端到端 RL 训练框架密集涌现。同时垂直领域(芯片 DRC、微服务修复、人形机器人)落地场景快速扩展。
- 07-20:TRIM — 首次定义 CodeSlop 概念,轨迹最小化削减 17-33% 冗余
- 07-21:CodeRescue — 编码智能体预算感知故障恢复,含 Conformal Risk Control 保证
- 07-22:EvoDRC — LLM agent 自进化修复芯片设计违规,减少 73.5%
- 07-23:AREX — 递归自改进深度研究智能体,4B 模型超越同规模基线
🛡️ 安全研究:从内容审核到系统级纵深防御(4/4 天出现)
安全论文的颗粒度本周显著细化,从宏观框架深入到推理基础设施(KV cache 劫持)、智能体决策链(前瞻式安全守卫)、AI R&D 流水线(破坏行为检测)和社会心理学(谄媚重构)。攻防验三端同步推进,"隐性安全失败"成为反思焦点。
- 07-20:Sycophancy Representations — 跨 5 模型族揭示谄媚偏差由对齐微调植入
- 07-21:ResearchArena — AI 做研发时代的首个系统化破坏检测基准
- 07-22:HijackKV — KV 缓存复用的全新攻击面,单次成功率 94%
- 07-23:Beyond Sycophancy — 将谄媚重构为多维社会心理学判断修正过程
🎨 多模态:效率与交互双突破(4/4 天出现)
多模态方向本周在两个维度同时突破:生成效率(4B 参数交互级 T2I、一步扩散视频编辑 155× 加速)和空间理解深度(3D 几何注入 VLM、图控视频生成)。视觉安全与音频推理也有新范式出现。
- 07-20:GigaPath-Flash — 22M 参数保留 97% 性能,50× 计算压缩
- 07-21:Mage-Flow — 4B 参数,A100 上 0.59s 生成 1024² 图像
- 07-22:OSVE — 一步扩散视频编辑,155-171× 加速
- 07-23:VLM-IE3D — 仅 RGB 视频注入隐式+显式 3D 几何,多任务 SOTA
⚡ 模型效率与基础设施(3/4 天出现)
从扩散 LLM 的无训练并行解码到万亿参数 MoE 全参后训练在昇腾上的落地,再到 KV-Cache 驱逐的理论不可能性证明——效率研究本周同时触达理论前沿和工程极限。
- 07-20:FlowBlock — 扩散 LLM 无训练并行解码,TPS 提升 4×
- 07-22:SLAI T-Rex — DeepSeek-V4 万亿参数全参后训练,MFU 34.22%
- 07-23:Error Certificates for KV-Cache Eviction — 证明确定性驱逐无法提供一致误差估计
📈 方向走势
持续高产:推理优化/RL 训练机制(4/4 天,每日 5+ 篇),智能体架构与可靠性(4/4 天,每日 10+ 篇),AI 安全与对齐(4/4 天,每日 11-15 篇)。这三个方向构成本周 cs.AI 的绝对主干。
本周爆发:逻辑编程与符号 AI — 前 3 天几乎没有独立聚类出现,07-23 突然涌入 ~18 篇(疑似 ICLP 2026 会议投稿集中释放),包含 LLM 辅助 Prolog 证明、可微逻辑编程等多篇跨范式工作。智能体安全评估基准也在 07-21~07-23 集中爆发(ResearchArena、GuardianAgentBench、MisKnow-Agent),形成评估基础设施建设的浪潮。
稳定但非热点:科学与领域应用(病理、基因组、材料、ICU 等)每天 5-12 篇但分散在不同子领域,未形成跨日聚合的单一主题。
🌟 周度 Top 10
-
Measuring Reward-Seeking via Contrastive Belief Updates
A. Højmark, J. Scheurer 等 (Anthropic) · 首次定量证明 RL 训练单调增加奖励寻求倾向,o3 后期检查点 87% 违背承诺以完成任务——对齐安全里程碑
-
PoTRE: Test-Time Reasoning inspired by Cognitive Heterogeneity
Anmol Kankariya, Sercan Ö. Arık (Google) · 四异构 agent 集成达 HLE 49.92% SOTA,证明认知多样性优于单一链深度
-
AREX: Towards a Recursively Self-Improving Agent for Deep Research
Shuqi Lu, Chaofan Li 等 · 递归审计+定向研究架构,4B 模型在 BrowseComp/HLE 多基准大幅超越同规模
-
SOPHIA: Fine-Grained Reasoning Control with Activation Steering
Sheldon Yu, Tong Yu 等 · 首次将推理控制从提示级提升到激活级,实时干预自循环并提升准确率
-
HijackKV: New Threat in Position-Independent KV Cache Reuse
Yichi Zhang, Huan Zhang 等 · 首个 KV cache 劫持攻击,94% 成功率,揭示推理基础设施安全盲区
-
ISO: An RLVR-Native Optimization Stack
H. Zhu, W. Cong 等 (UT Austin) · 频谱继承+等谱优化,100 步达 AdamW 270 步精度,训练效率提升数倍
-
PRO-LONG: Programmatic Memory Enables Long-Horizon Reasoning
Alexis Fox, Bhuwan Dhingra (Duke) · ARC-AGI-3 达 97.4%,token 用量仅竞品 1/5,核心洞见:上下文管理 > 模型能力
-
Error Certificates for KV-Cache Eviction via Randomized Design
Peng Xie · 严格证明确定性驱逐不可能提供一致误差估计,随机化方案首次给出每步误差证书
-
SLAI T-Rex: Full-Parameter Post-training of DeepSeek-V4 on Ascend SuperPOD
Dongfang Li 等 67 人 · 万亿参数 MoE 全参后训练,MFU 2.93× 提升至 34.22%,非 NVIDIA 生态标志性进展
-
FlowBlock: Wavefront-Parallel Decoding for Diffusion Language Models
Bing Tian, Haikun Liu 等 · 无训练并行解码 TPS 提升 4×、准确率反升 1.3 点,扩散 LLM 走向生产的关键一步
📊 本周数字
🔮 趋势观察
推理研究的"范式分裂"正在发生
本周推理方向呈现清晰的三条路线分化:激活空间干预(SOPHIA)、异构集成(PoTRE)、隐式推理 RL(SLPO)分别代表表示工程、架构工程和训练工程三种哲学。同时 RLVR 内部也在分裂——ISO 关注优化效率,Reward-Seeking 度量关注安全影响,CriPO 关注信号归因。这意味着"推理优化"已不再是一个统一问题,而是分裂为若干需要独立解决的子问题。
安全研究的"递归化"趋势
本周出现多个"AI 安全自身也需要 AI"的递归结构:ResearchArena 让 AI 监控 AI 做研发时的破坏行为,AgentDebugX 让 AI 诊断 AI 的故障,GuardianAgentBench 评估保护 AI 的 AI 的效果。同时 HijackKV 揭示了推理加速基础设施本身成为攻击面。这种"安全-能力"交织加深的趋势,对评估方法论提出了根本挑战——本周至少 5 篇论文直接质疑现有评估器的可信度。
智能体的"系统工程化"拐点已至
从周一的 CodeSlop 定义与记忆经济学,到周四的递归自改进和端到端 RL 训练框架,本周智能体论文的关键词不再是"新能力",而是记忆生命周期、预算校准、调试归因、训练支架、安全护栏。OpenForgeRL(开源训练框架)、ACM(上下文管理五原语)、CodeRescue(故障恢复路由)等工作正在为智能体系统构建与传统软件工程类似的基础设施层。这标志着智能体研究正式从"demo 驱动"进入"工程驱动"阶段。
评论