arXiv cs.AI 周报 (2026-07-06~2026-07-12)

arXiv cs.AI 周报 (2026-07-06~2026-07-12)

Meta-summary · 基于 4/7 daily HTML · 2026-07-06~2026-07-12 · 缺 20260710, 20260711, 20260712
Generated by tanar · 2026-07-13 00:03

🗓️ 本周覆盖

本周(2026-07-06 ~ 2026-07-12)共 4/7 天 daily 报告可用。 缺失日期:2026-07-102026-07-112026-07-12(这些日的论文不在本汇总范围内)。 下文所有数字和取舍都基于这 4 天的 daily picks。

🔥 本周主题

🛡️ 智能体安全:从单模型攻防到系统级治理(4/4 天出现)

本周最强信号。Agent 安全论文从首日的数据注入/记忆投毒,演进到 MCP 协议隐写攻击、部署规则因果性验证、推理权重提取审计,覆盖了攻击面发现→协议级漏洞→系统级防御→部署前风险预测的完整链条。社区正从"模型层安全"快速迁移到"Agent 部署层安全"。

⚡ KV Cache 压缩与推理加速工程化(4/4 天出现)

从 KVpop 的预测性在线剪枝到 DepthWeave-KV 的 8.3x 跨层残差分解,再到 DSpark 在 DeepSeek-V4 生产线上 60-85% 加速,推理优化本周全面走向工程可部署。频率引导、残差分解、置信度调度三条技术路线同步收敛。

🤖 智能体记忆、技能与可靠性工程(4/4 天出现)

Agent 研究本周的核心叙事从"能力演示"转向"可靠工程"。记忆从被动检索进化为主动导航(NapMem)和扩展工作记忆(Memory in the Loop);技能管理走向 SOP 自动合成(EvoSOP)和 216K 规模开放技能库(SkillCenter);失败归因(AgentLocate)和早期中止(Doomed from the Start)让 Agent 变得可诊断。

  • 2026-07-06:Memory in the Loop — 将记忆延迟从百毫秒降至 ~100μs
  • 2026-07-07:StateFuse — CRDT 冲突感知多智能体共享记忆
  • 2026-07-08:EvoSOP — 从轨迹中自动提炼可复用 SOP
  • 2026-07-09:WebSwarm — 递归多智能体深度+广度搜索编排

🧪 RL 后训练方法快速碎片化(3/4 天出现)

GRPO 作为基线正被多路超越:竞争式互评(Agon)、隐式策略偏移奖励(Direct-OPD)、信用分配校准(TACO)、异步单 rollout(SAO)各自正交但尚无统一框架。同时 GRPO 自身已扩散到药物生成、语音 ASR、多模态扩散等跨域场景,预示整合期临近。

  • 2026-07-06:Direct-OPD — RL 策略偏移作为隐式奖励,4h 8×A100 大幅提升小模型
  • 2026-07-08:Agon — 竞争式跨模型 RL,DeepMath pass@1 翻倍
  • 2026-07-08:SAO — 单 rollout 异步优化,已部署于 GLM-5.2 训练

🔬 AI 辅助数学与形式化验证突破(3/4 天出现)

AI 数学能力本周完成从"解题"到"发现"的跨越:Danus 独立证明代数几何新定理;代码智能体在 Coq 上实现 100% 全自动证明覆盖;Terence Tao 参与的 AI4Math 路线图为领域指明方向。LLM 多智能体还完成了矩阵积态基本定理的 Lean 形式化。

📈 方向走势

持续高产(4/4 天):智能体安全(每天 5-10+ 篇)、KV Cache/推理效率(每天 3-5 篇)、智能体记忆与协作(每天 4-8 篇)。这三条线已形成稳定的研究社区,短期内不会退潮。

本周爆发:AI 辅助数学从第 2 天(Danus 系统论文 + 配套定理证明)开始集中出现,第 3 天(AI4Math 路线图 + 张量网络形式化)进一步加强,形成明确的"AI 做数学"叙事高峰。多智能体安全(Institutional Red-Teaming、Multi-Agent AI Control)在第 3 天集中爆发,将安全研究从单模型推向群体行为层面。

渐强趋势:医疗 AI 从第 2 天的放射学基础模型(Harrison.Rad),到第 4 天的安全导向诊断框架(AegisDx)和 6,668 例多中心临床验证(HCC-STAR),呈现从"能力展示"到"安全工程+大规模验证"的成熟化轨迹。

🌟 周度 Top 10

  1. LLM-as-a-Verifier: A General-Purpose Verification Framework

    Jacky Kwok, Chelsea Finn, Marco Pavone, Ion Stoica 等 · 07-06 Top 10 · 将验证确立为第四个 scaling 维度,连续分数 + 三维度 scaling 在 Terminal-Bench V2 (86.5%)、SWE-Bench Verified (78.2%) 达到 SOTA

  2. DSpark: Confidence-Scheduled Speculative Decoding

    Xin Cheng 等 (DeepSeek) · 07-06 Top 10 · 已在 DeepSeek-V4 真实线上流量部署,加速 60-85%,生产级验证的推理优化标杆

  3. Agon: Competitive Cross-Model RL with Implicit Rival Grading

    Vladislav Beliaev · 07-08 Top 10 · 无过程标签的竞争式互评 RL,DeepMath hard split pass@1 翻倍,跨 Qwen3/Gemma 4 可复现

  4. Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets

    Jack Hopkins, Fabien Roger 等 · 07-09 Top 10 · 权重空间操作暴露模型隐藏信息,2B-32B 模型上秘密暴露频率提升 10×,安全审计新范式

  5. Harnessing Code Agents for Automatic Software Verification

    Shuangxiang Kan 等 · 07-07 Top 10 · 通用代码智能体 + 验证 harness 实现 Iris/Coq 4,257 引理 100% 全自动证明,颠覆传统 LLM Prover 设计

  6. Agent Data Injection Attacks are Realistic Threats to AI Agents

    Woohyuk Choi 等 · 07-06 Top 10 · 发现 Claude Code/Codex/Gemini CLI 的 ADI 漏洞,绕过所有现有 IPI 防御,暴露受信/不受信数据隔离缺失

  7. SciReasoner: Native Structural Reasoning across Proteins, Molecules and Crystals

    Chen Tang, Lei Bai 等 · 07-08 Top 10 · 统一结构词汇表实现可审计推理链,86 个基准中 67 个 SOTA,专家盲评 98% 偏好

  8. Danus: Orchestrating Mathematical Reasoning Agents with Fact-Graph Memory

    Jihao Liu 等 · 07-07 Top 10 · 共享事实图编排并行工人智能体,在代数几何中独立完成新定理的构造与证明

  9. DepthWeave-KV: Token-Adaptive Cross-Layer Residual Factorization

    Anna Córdoba 等 · 07-07 Top 10 · 跨层残差分解 + 融合 CUDA kernel,64K 上下文 8.3x KV 显存压缩几乎无质量损失

  10. WebSwarm: Recursive Multi-Agent Orchestration for Deep-and-Wide Web Search

    Xiaoshuai Song 等 · 07-09 Top 10 · 渐进式递归委派 + 同构节点经验复用,四个搜索基准全面超越现有方法

📊 本周数字

~521
4 天合计 cs.AI 论文提交量(159+117+136+109)
~90
安全/对齐相关论文(4 天累计,本周最大集群)
cs.LG
最活跃交叉子类(4 天均为第二大子类:58/25→57/33 篇)
5/4
本周主题中跨越全部 4 天的有 3 个,3 天的有 2 个
DeepSeek · Stanford · 清华/北大
最活跃机构(多篇 Top 10 入选或多日出现)

🔮 趋势观察

Agent 安全研究完成"三级跳"

四天内安全研究经历了清晰的层次跃迁:第一层(07-06)发现具体攻击面(数据注入、记忆投毒);第二层(07-07~08)上升到协议/制度层面(MCP 隐写、部署规则因果性);第三层(07-08~09)建立系统化方法论(部署模拟预测、权重空间审计、CoT 监控失效分析)。这一演进速度表明 Agent 安全正从"发现漏洞"快速走向"建立治理框架",预计下半年将出现更多安全工程标准和测试套件。

推理优化从论文走向生产部署的"最后一公里"

DSpark(DeepSeek-V4 线上 60-85% 加速)和 SAO(已部署于 GLM-5.2 训练)标志着推理优化和 RL 训练方法不再仅是基准数字游戏。KV Cache 压缩在一周内出现了预测性剪枝(KVpop)、跨层残差分解(DepthWeave-KV)、频率引导(FreqDepthKV)三条技术路线,均给出了融合 CUDA 实现或生产环境数据——技术收敛与工程化正在同步发生。

AI 数学推理从"辅助解题"跃升至"独立发现"

Danus 在代数几何中独立构造并证明新结果(且早于人类团队公开),Aria 在 Coq/Lean 上实现 100% 全自动证明覆盖,Tao 参与的 AI4Math 路线图为领域指明方向——三者共同标志着 AI 辅助数学研究从"验证已知"进入"发现未知"的新阶段。这可能是本周最具长期影响力的信号。