arXiv cs.AI 周报 (2026-07-06~2026-07-12)
🗓️ 本周覆盖
本周(2026-07-06 ~ 2026-07-12)共 4/7 天 daily 报告可用。
缺失日期:2026-07-10、2026-07-11、2026-07-12(这些日的论文不在本汇总范围内)。
下文所有数字和取舍都基于这 4 天的 daily picks。
🔥 本周主题
🛡️ 智能体安全:从单模型攻防到系统级治理(4/4 天出现)
本周最强信号。Agent 安全论文从首日的数据注入/记忆投毒,演进到 MCP 协议隐写攻击、部署规则因果性验证、推理权重提取审计,覆盖了攻击面发现→协议级漏洞→系统级防御→部署前风险预测的完整链条。社区正从"模型层安全"快速迁移到"Agent 部署层安全"。
- 2026-07-06:Agent Data Injection Attacks — 发现 Claude Code/Codex/Gemini CLI 的 ADI 漏洞
- 2026-07-07:Unicode TAG-Block Concealment in MCP — MCP 审批视图与模型上下文的保真度缺陷
- 2026-07-08:Institutional Red-Teaming — 228 场景实验证明部署规则比模型更决定群体安全
- 2026-07-09:Overthinking — 推理权重放大提取训练阶段隐藏信息,为模型审计开辟新路径
⚡ KV Cache 压缩与推理加速工程化(4/4 天出现)
从 KVpop 的预测性在线剪枝到 DepthWeave-KV 的 8.3x 跨层残差分解,再到 DSpark 在 DeepSeek-V4 生产线上 60-85% 加速,推理优化本周全面走向工程可部署。频率引导、残差分解、置信度调度三条技术路线同步收敛。
- 2026-07-06:DSpark — DeepSeek-V4 线上部署,60-85% 加速
- 2026-07-06:KVpop — 学习未来注意力目标,88% 压缩仅损 3%
- 2026-07-07:DepthWeave-KV — 8.3x 显存压缩,64K 上下文 72.8 tokens/s
- 2026-07-09:Relaxed Speculative Decoding 实证指南 — 统一框架揭示 drafter 质量依赖
🤖 智能体记忆、技能与可靠性工程(4/4 天出现)
Agent 研究本周的核心叙事从"能力演示"转向"可靠工程"。记忆从被动检索进化为主动导航(NapMem)和扩展工作记忆(Memory in the Loop);技能管理走向 SOP 自动合成(EvoSOP)和 216K 规模开放技能库(SkillCenter);失败归因(AgentLocate)和早期中止(Doomed from the Start)让 Agent 变得可诊断。
- 2026-07-06:Memory in the Loop — 将记忆延迟从百毫秒降至 ~100μs
- 2026-07-07:StateFuse — CRDT 冲突感知多智能体共享记忆
- 2026-07-08:EvoSOP — 从轨迹中自动提炼可复用 SOP
- 2026-07-09:WebSwarm — 递归多智能体深度+广度搜索编排
🧪 RL 后训练方法快速碎片化(3/4 天出现)
GRPO 作为基线正被多路超越:竞争式互评(Agon)、隐式策略偏移奖励(Direct-OPD)、信用分配校准(TACO)、异步单 rollout(SAO)各自正交但尚无统一框架。同时 GRPO 自身已扩散到药物生成、语音 ASR、多模态扩散等跨域场景,预示整合期临近。
- 2026-07-06:Direct-OPD — RL 策略偏移作为隐式奖励,4h 8×A100 大幅提升小模型
- 2026-07-08:Agon — 竞争式跨模型 RL,DeepMath pass@1 翻倍
- 2026-07-08:SAO — 单 rollout 异步优化,已部署于 GLM-5.2 训练
🔬 AI 辅助数学与形式化验证突破(3/4 天出现)
AI 数学能力本周完成从"解题"到"发现"的跨越:Danus 独立证明代数几何新定理;代码智能体在 Coq 上实现 100% 全自动证明覆盖;Terence Tao 参与的 AI4Math 路线图为领域指明方向。LLM 多智能体还完成了矩阵积态基本定理的 Lean 形式化。
- 2026-07-07:Danus — AI 推理智能体自主证明代数几何定理
- 2026-07-07:Code Agents for Verification — Coq/Lean 定理全覆盖证明
- 2026-07-08:LLM-Driven Formal Mathematics — Tao 参与的 AI4Math 路线图
📈 方向走势
持续高产(4/4 天):智能体安全(每天 5-10+ 篇)、KV Cache/推理效率(每天 3-5 篇)、智能体记忆与协作(每天 4-8 篇)。这三条线已形成稳定的研究社区,短期内不会退潮。
本周爆发:AI 辅助数学从第 2 天(Danus 系统论文 + 配套定理证明)开始集中出现,第 3 天(AI4Math 路线图 + 张量网络形式化)进一步加强,形成明确的"AI 做数学"叙事高峰。多智能体安全(Institutional Red-Teaming、Multi-Agent AI Control)在第 3 天集中爆发,将安全研究从单模型推向群体行为层面。
渐强趋势:医疗 AI 从第 2 天的放射学基础模型(Harrison.Rad),到第 4 天的安全导向诊断框架(AegisDx)和 6,668 例多中心临床验证(HCC-STAR),呈现从"能力展示"到"安全工程+大规模验证"的成熟化轨迹。
🌟 周度 Top 10
-
LLM-as-a-Verifier: A General-Purpose Verification Framework
Jacky Kwok, Chelsea Finn, Marco Pavone, Ion Stoica 等 · 07-06 Top 10 · 将验证确立为第四个 scaling 维度,连续分数 + 三维度 scaling 在 Terminal-Bench V2 (86.5%)、SWE-Bench Verified (78.2%) 达到 SOTA
-
DSpark: Confidence-Scheduled Speculative Decoding
Xin Cheng 等 (DeepSeek) · 07-06 Top 10 · 已在 DeepSeek-V4 真实线上流量部署,加速 60-85%,生产级验证的推理优化标杆
-
Agon: Competitive Cross-Model RL with Implicit Rival Grading
Vladislav Beliaev · 07-08 Top 10 · 无过程标签的竞争式互评 RL,DeepMath hard split pass@1 翻倍,跨 Qwen3/Gemma 4 可复现
-
Overthinking: Amplifying Reasoning Weights to Extract Learned Secrets
Jack Hopkins, Fabien Roger 等 · 07-09 Top 10 · 权重空间操作暴露模型隐藏信息,2B-32B 模型上秘密暴露频率提升 10×,安全审计新范式
-
Harnessing Code Agents for Automatic Software Verification
Shuangxiang Kan 等 · 07-07 Top 10 · 通用代码智能体 + 验证 harness 实现 Iris/Coq 4,257 引理 100% 全自动证明,颠覆传统 LLM Prover 设计
-
Agent Data Injection Attacks are Realistic Threats to AI Agents
Woohyuk Choi 等 · 07-06 Top 10 · 发现 Claude Code/Codex/Gemini CLI 的 ADI 漏洞,绕过所有现有 IPI 防御,暴露受信/不受信数据隔离缺失
-
SciReasoner: Native Structural Reasoning across Proteins, Molecules and Crystals
Chen Tang, Lei Bai 等 · 07-08 Top 10 · 统一结构词汇表实现可审计推理链,86 个基准中 67 个 SOTA,专家盲评 98% 偏好
-
Danus: Orchestrating Mathematical Reasoning Agents with Fact-Graph Memory
Jihao Liu 等 · 07-07 Top 10 · 共享事实图编排并行工人智能体,在代数几何中独立完成新定理的构造与证明
-
DepthWeave-KV: Token-Adaptive Cross-Layer Residual Factorization
Anna Córdoba 等 · 07-07 Top 10 · 跨层残差分解 + 融合 CUDA kernel,64K 上下文 8.3x KV 显存压缩几乎无质量损失
-
WebSwarm: Recursive Multi-Agent Orchestration for Deep-and-Wide Web Search
Xiaoshuai Song 等 · 07-09 Top 10 · 渐进式递归委派 + 同构节点经验复用,四个搜索基准全面超越现有方法
📊 本周数字
🔮 趋势观察
Agent 安全研究完成"三级跳"
四天内安全研究经历了清晰的层次跃迁:第一层(07-06)发现具体攻击面(数据注入、记忆投毒);第二层(07-07~08)上升到协议/制度层面(MCP 隐写、部署规则因果性);第三层(07-08~09)建立系统化方法论(部署模拟预测、权重空间审计、CoT 监控失效分析)。这一演进速度表明 Agent 安全正从"发现漏洞"快速走向"建立治理框架",预计下半年将出现更多安全工程标准和测试套件。
推理优化从论文走向生产部署的"最后一公里"
DSpark(DeepSeek-V4 线上 60-85% 加速)和 SAO(已部署于 GLM-5.2 训练)标志着推理优化和 RL 训练方法不再仅是基准数字游戏。KV Cache 压缩在一周内出现了预测性剪枝(KVpop)、跨层残差分解(DepthWeave-KV)、频率引导(FreqDepthKV)三条技术路线,均给出了融合 CUDA 实现或生产环境数据——技术收敛与工程化正在同步发生。
AI 数学推理从"辅助解题"跃升至"独立发现"
Danus 在代数几何中独立构造并证明新结果(且早于人类团队公开),Aria 在 Coq/Lean 上实现 100% 全自动证明覆盖,Tao 参与的 AI4Math 路线图为领域指明方向——三者共同标志着 AI 辅助数学研究从"验证已知"进入"发现未知"的新阶段。这可能是本周最具长期影响力的信号。
评论