AI 每日进展速报 - 2026-04-07
新旧
正在统计...
来源
当前筛选条件下没有条目。
图像生成/编辑
arXiv
- [2026-03-31] Adversarial Prompt Injection Attack on Multimodal Large Language Models 📖1
- 赛道归属: 多模态安全(MLLM视觉提示注入/对抗攻击)
- 核心创新点: 提出不可感知的视觉Prompt Injection:用受限文本叠加作为“语义锚点”嵌入恶意指令,同时优化不可见扰动,使被攻击图像在粗粒度与细粒度特征空间同时对齐“恶意视觉目标+恶意文本目标”;并将视觉目标实例化为文本渲染图像、在迭代中逐步精炼以提升语义一致性与跨模型迁移,从而对闭源强模型实现更有效的视觉侧注入攻击。
- [2026-04-06] Think in Strokes, Not Pixels: Process-Driven Image Generation via Interleaved Reasoning 🆕NEW
- 赛道归属: 文生图(多步生成/可解释生成过程)
- 核心创新点: 提出“过程驱动”的多轮生成范式,将一次性合成拆解为“文本规划→视觉草稿→文本反思→视觉细化”的交错推理轨迹;通过“视觉中间态约束下一轮文本推理、文本推理显式指导视觉演化”的闭环实现可解释、可监督的生成过程。针对中间态歧义,设计密集逐步监督:视觉侧强调空间与语义一致性,文本侧在保留既有视觉信息的同时定位并纠正违背提示的元素,从而稳定多步迭代并提升可控性与可诊断性。
- [2026-04-06] Training-Free Refinement of Flow Matching with Divergence-based Sampling 🆕NEW
- 赛道归属: 推理优化(Flow Matching/采样加速与质量提升)
- 核心创新点: 提出无需训练的 Flow Divergence Sampler,在每个数值求解步之前对中间状态进行“推理期修正”,缓解边际速度场因样本速度冲突而将轨迹推向低密度区域的问题;关键在于用推理时可计算的“速度场散度”量化误导严重程度,并据此将状态引导至更少歧义的区域。方法即插即用,兼容标准ODE/SDE求解器与现成flow骨干,在文生图与逆问题等任务上提升保真度。
- [2026-04-06] Erasure or Erosion? Evaluating Compositional Degradation in Unlearned Text-To-Image Diffusion Models 🆕NEW
- 赛道归属: 文生图安全/模型遗忘(Unlearning评测)
- 核心创新点: 从“组合式生成能力”角度系统评估扩散模型的概念遗忘(以SD1.4去除裸露为例),揭示仅以“擦除成功率”衡量会掩盖对通用生成能力的损伤;通过T2I-CompBench++与GenEval等基准,实证发现“强擦除↔组合完整性(属性绑定/空间推理/计数)退化”的稳定权衡,并指出需要将语义保持纳入遗忘目标与评测体系,而非只做定点抑制。
- [2026-04-06] Training-Free Image Editing with Visual Context Integration and Concept Alignment 🆕NEW
- 赛道归属: 图像编辑(训练免/上下文条件编辑)
- 核心创新点: 提出 VicoEdit:训练免且无需扩散反演的视觉上下文注入编辑框架,直接利用“上下文图像”驱动源图到目标图的变换,避免反演带来的轨迹偏移与一致性问题;并设计由“概念对齐”引导的后验采样,在不训练的前提下强化编辑一致性与可控性。整体作为即插即用方案,在编辑质量上可超过部分训练式方法。
- [2026-04-05] Graphic-Design-Bench: A Comprehensive Benchmark for Evaluating AI on Graphic Design Tasks 🆕NEW
- 赛道归属: 多模态评测(图形设计理解与生成基准)
- 核心创新点: 构建首个面向“专业图形设计全流程”的综合基准 GraphicDesignBench:覆盖布局、字体排印、信息图、模板/设计语义、动画五大轴,并同时评测理解与生成;以真实分层模板为基础,定义包含空间准确性、文本保真、结构有效性(如矢量代码合法性)等指标体系,从而把“结构化布局推理、矢量生成、精细排版感知、动画时序分解”等现有模型短板显式量化与可复现追踪。
- [2026-04-05] GENFIG1: Visual Summaries of Scholarly Work as a Challenge for Vision-Language Models 🆕NEW
- 赛道归属: 多模态评测(科学图示生成/视觉摘要)
- 核心创新点: 提出 GENFIG1 基准,将“论文 Figure 1 视觉摘要生成”定义为需要科学理解与视觉设计耦合的生成任务:模型需从标题/摘要/引言/图注中抽取关键概念并组织成连贯、忠实且具传播效果的图形表达。数据来自顶会论文并经严格质控,同时给出与专家评审相关性较高的自动评测指标,用于系统性暴露现有VLM/生成模型在“概念提炼+图形化表达”上的能力缺口。
- [2026-04-05] ATSS: Detecting AI-Generated Videos via Anomalous Temporal Self-Similarity 🆕NEW
- 赛道归属: 视频取证/检测(AIGC视频检测)
- 核心创新点: 提出 AIGV 的新型指纹“异常时间自相似性”:指出生成视频受提示锚点驱动呈更确定的全局演化轨迹,导致跨时间的视觉/语义相关性异常重复;据此构建三重相似性表示(视觉、文本、跨模态相似矩阵),用独立Transformer编码并通过双向交叉注意力融合建模时序动态,从而捕获全局生成逻辑而非局部伪影,在多基准上实现更强泛化的检测性能。
- [2026-04-05] 1.x-Distill: Breaking the Diversity, Quality, and Efficiency Barrier in Distribution Matching Distillation 🆕NEW
- 赛道归属: 推理优化(扩散模型蒸馏/少步生成)
- 核心创新点: 提出 1.x-Distill,将分布匹配蒸馏从“整数步”推进到“分数步(1.x步)”可用区间,缓解≤2步时常见的多样性坍塌与保真下降;方法上分析并修正 teacher CFG 在DMD中的关键作用以抑制模式坍塌,并提出两阶段 Stagewise Focused Distillation:先用保多样的分布匹配学粗结构,再用与推理一致的对抗蒸馏补细节;同时引入轻量补偿模块实现 Distill-Cache 协同训练,把块级缓存自然纳入蒸馏管线,在极低NFE下兼顾质量/多样性/效率。
- [2026-04-05] SafeCtrl: Region-Aware Safety Control for Text-to-Image Diffusion via Detect-Then-Suppress 🆕NEW
- 赛道归属: 文生图安全控制(区域级内容安全/对抗鲁棒)
- 核心创新点: 提出 SafeCtrl 的“先检测后抑制”区域感知安全框架:通过注意力引导的 Detect 模块精确定位风险区域,再用局部 Suppress 模块仅在该区域内中和有害语义、将不安全对象替换为安全替代物,从而显著降低“全局擦除”带来的上下文损伤;并用图像级 DPO 优化抑制策略以提升安全-保真权衡与对抗提示绕过的鲁棒性。
GitHub
- [2026-04-07] YouMind-OpenLab/awesome-nano-banana-pro-prompts ⭐10659
- [2026-04-06] Light-Heart-Labs/DreamServer ⭐451
- [2026-04-07] jd-opensource/JoyAI-Image ⭐356 🆕NEW
- [2026-04-06] AceDataCloud/Nexior ⭐351 🆕NEW
- [2026-04-05] akandr/bc250 ⭐57 🆕NEW
视频生成/编辑
arXiv
- [2026-04-06] Preserving Forgery Artifacts: AI-Generated Video Detection at Native Scale 🆕NEW
- 赛道归属: AI生成视频检测 / 视频取证
- 核心创新点: 提出“原生尺度”检测范式:基于Qwen2.5-VL的ViT在可变分辨率与可变时长上直接建模,避免固定resize/crop导致的高频伪造痕迹丢失与空间畸变,从而更好捕捉细粒度伪影与时空不一致;同时构建覆盖15种SOTA生成器、14万+视频的大规模数据集与面向超逼真内容的Magic Videos基准,推动检测训练/评测从“过时分布”迁移到“现代生成模型分布”。
- [2026-04-06] Beyond Few-Step Inference: Accelerating Video Diffusion Transformer Model Serving with Inter-Request Caching Reuse 🆕NEW
- 赛道归属: 推理优化 / 视频扩散模型服务加速
- 核心创新点: 提出Chorus跨请求缓存复用机制,突破以往仅在单请求扩散步内做冗余跳步的局限;设计三阶段缓存策略:早期对相似请求进行latent特征全量复用,中期对特定latent区域进行局部复用,并通过Token-Guided Attention Amplification增强条件语义对齐,使“全量复用”可延伸到更后期去噪步;在4-step蒸馏工业模型上实现最高45%加速,覆盖以往缓存方法失效的场景。
- [2026-04-06] UENR-600K: A Large-Scale Physically Grounded Dataset for Nighttime Video Deraining 🆕NEW
- 赛道归属: 视频复原 / 视频去雨
- 核心创新点: 构建UENR-600K:60万对1080p配对帧的“物理一致”夜间去雨数据集,使用Unreal Engine将雨建模为3D粒子并与人工光照交互,显式覆盖夜雨的颜色折射、局部照明、遮挡与雨幕等物理现象,弥补2D叠加合成数据的域差;方法上将去雨重构为video-to-video生成任务,改造Wan 2.2视频生成模型作为强生成先验的去雨基线,显著缩小sim-to-real泛化差距并建立新SOTA基线。
- [2026-04-05] DriveVA: Video Action Models are Zero-Shot Drivers 🆕NEW
- 赛道归属: 自动驾驶世界模型 / 视觉规划
- 核心创新点: 提出DriveVA联合生成式解码:在共享latent生成过程中同时解码未来视频与动作序列(轨迹),用DiT解码器实现“视觉想象—轨迹规划”强耦合,缓解以往松耦合规划带来的视频-轨迹不一致;继承大规模视频生成模型的运动与物理先验以提升跨域泛化与零样本能力,并引入视频续写策略增强长时滚动一致性,在闭环NAVSIM上取得高PDM并显著降低跨数据集误差与碰撞率。
- [2026-04-05] OP-GRPO: Efficient Off-Policy GRPO for Flow-Matching Models 🆕NEW
- 赛道归属: 生成模型后训练 / 强化学习对齐
- 核心创新点: 提出首个面向Flow-Matching模型的Off-Policy GRPO,用可复用的高质量轨迹回放缓冲区提升样本效率;针对off-policy分布偏移,提出序列级重要性采样校正以保持GRPO裁剪机制的稳定性;进一步发现后期去噪步的off-policy ratio病态,提出截断晚期轨迹以稳定训练,在图像与视频生成上以约34.2%训练步数达到/超过on-policy Flow-GRPO效果。
- [2026-04-05] ATSS: Detecting AI-Generated Videos via Anomalous Temporal Self-Similarity 🆕NEW
- 赛道归属: 视频取证/检测(AIGC视频检测)
- 核心创新点: 提出 AIGV 的新型指纹“异常时间自相似性”:指出生成视频受提示锚点驱动呈更确定的全局演化轨迹,导致跨时间的视觉/语义相关性异常重复;据此构建三重相似性表示(视觉、文本、跨模态相似矩阵),用独立Transformer编码并通过双向交叉注意力融合建模时序动态,从而捕获全局生成逻辑而非局部伪影,在多基准上实现更强泛化的检测性能。
- [2026-04-04] ActivityForensics: A Comprehensive Benchmark for Localizing Manipulated Activity in Videos 🆕NEW
- 赛道归属: 视频取证 / 篡改活动定位
- 核心创新点: 提出ActivityForensics首个大规模“活动级”篡改时序定位基准:将6K+伪造活动片段无缝融入上下文,强调事件语义被改写但视觉一致性极高的难例,补齐以往偏外观篡改(换脸/抹除)的评测空白;并提出TADiff基线,通过扩散式特征正则将隐蔽伪影“扩散显化”,提升对活动篡改的可分性;同时给出intra/cross-domain与open-world协议,系统化评估现有定位器的泛化能力。
- [2026-04-04] Rethinking Position Embedding as a Context Controller for Multi-Reference and Multi-Shot Video Generation 🆕NEW
- 赛道归属: 视频生成 / 多参考多镜头一致性控制
- 核心创新点: 将位置编码重新定义为“上下文控制器”PoCo:在多参考且外观高度相似时,利用token侧信息进行精确的token级匹配与检索,缓解语义相近token导致的reference confusion;在不破坏隐式语义一致性建模的前提下,提升跨镜头角色一致性与参考保真度,从机制上补足仅依赖语义检索/注意力的控制瓶颈。
- [2026-04-04] SymphoMotion: Joint Control of Camera Motion and Object Dynamics for Coherent Video Generation 🆕NEW
- 赛道归属: 可控视频生成 / 相机运动与物体运动联合控制
- 核心创新点: 提出SymphoMotion统一运动控制框架,在单模型内解耦并联合控制相机轨迹与物体动力学:相机侧引入显式轨迹+几何感知线索以稳定视角转换与结构一致性;物体侧融合2D引导与3D轨迹embedding实现具深度一致性的空间运动控制,避免2D线索将视差与真实物体运动纠缠;同时构建RealCOD-25K真实数据集,提供相机位姿与物体级3D轨迹配对,补齐统一控制所需数据缺口。
- [2026-04-04] CRAFT: Video Diffusion for Bimanual Robot Data Generation 🆕NEW
- 赛道归属: 视频生成用于机器人数据合成 / Sim2Real数据增强
- 核心创新点: 提出CRAFT:用视频扩散Transformer将仿真轨迹“渲染”为时序一致、照片级的双臂操作视频,并保留/生成与之对齐的动作标签;以Canny边缘等结构线索作为条件,将仿真提供的几何/运动约束注入扩散生成,从而在不重放真实机器人的情况下实现可控的数据扩增(物体位姿、视角、光照背景、跨机体迁移、多视角合成等),显著提升双臂策略在视角与外观变化下的泛化与成功率。
GitHub
- [2026-04-06] hao-ai-lab/FastVideo ⭐3346
- [2026-04-07] leofan90/Awesome-World-Models ⭐1446 🆕NEW
- [2026-04-07] ZeroLu/awesome-seedance ⭐1369 🆕NEW
- [2026-04-07] YouMind-OpenLab/awesome-seedance-2-prompts ⭐536
- [2026-04-07] vargHQ/sdk ⭐257
音频生成
arXiv
- [2026-04-06] OmniSonic: Towards Universal and Holistic Audio Generation from Video and Text 🆕NEW
- 赛道归属: 音频生成(视频/文本条件的扩散式音频生成;全景声场/多源音频合成)
- 核心创新点: 提出“Universal Holistic Audio Generation ”任务,强调同时生成屏幕内环境声、屏幕外环境声与人声的完整声场;提出基于flow-matching的扩散框架OmniSonic,在DiT中设计TriAttn三路跨注意力分别建模三类条件,并引入MoE门控自适应分配各条件对生成的贡献,从结构上解决“多源条件互相干扰/权重难平衡”的问题;同时构建覆盖典型“屏幕内/外+人声-环境声”组合的新基准UniHAGen-Bench以系统评测该能力。
- [2026-04-02] CoLoRSMamba: Conditional LoRA-Steered Mamba for Supervised Multimodal Violence Detection 🆕NEW
- 赛道归属: 多模态理解(音视频暴力检测;高效跨模态融合/状态空间模型)
- 核心创新点: 提出CoLoRSMamba,用“方向性Video→Audio”的条件化LoRA在不使用token级跨注意力的情况下实现跨模态调制:由VideoMamba的CLS token在每层生成通道级调制向量与稳定门控,直接作用于AudioMamba中选择性状态空间参数(Δ、B、C及步长通路)的投影,从而让音频动态对场景语义自适应、并提升噪声/弱相关音频下的鲁棒性;训练上结合二分类与对称AV-InfoNCE对齐clip级嵌入,强化跨模态一致性;并通过从NTU-CCTV与DVD构建“有音频可用”的过滤子集,提升多模态评测的可比性与公平性。
- [2026-04-02] Woosh: A Sound Effects Foundation Model 🆕NEW
- 赛道归属: 音频生成(音效基础模型;文本到音频/视频到音频;编解码与对齐)
- 核心创新点: 发布面向“音效”优化的开源基础模型Woosh,将音频生成系统拆解为可复用的模块化栈:高质量音频encoder/decoder、文本-音频对齐模型、以及文本到音频与视频到音频生成模型,形成从表征学习到条件生成的完整开源基座;同时提供蒸馏版T2A/V2A以在低资源与快速推理场景下保持可用性能,强调“可部署性/效率”作为基础模型能力的一部分;并在公私数据上对关键模块与现有开源方案进行对比评测,给出可复现实验与权重代码,降低社区复用门槛。
GitHub
- [2026-04-07] huggingface/diffusers ⭐33270
- [2026-04-02] Lightricks/LTX-2 ⭐5586
- [2026-04-03] FunAudioLLM/ThinkSound ⭐1298
- [2026-04-01] OpenMOSS/MOVA ⭐882 🆕NEW
- [2026-04-06] apocas/restai ⭐483
语言大模型
GitHub
- [2026-04-06] abhigyanpatwari/GitNexus ⭐23657
- [2026-04-06] DeusData/codebase-memory-mcp ⭐1271
- [2026-04-07] clice-io/clice ⭐1200
- [2026-04-07] justrach/codedb ⭐589 🆕NEW
- [2026-04-07] proxysoul/soulforge ⭐186 🆕NEW
多模态大模型
arXiv
- [2026-04-01] JAMMEval: A Refined Collection of Japanese Benchmarks for Reliable VLM Evaluation 📖1 🆕NEW
- 赛道归属: 多模态评测 / VLM评测基准(日语VQA)
- 核心创新点: 通过对7个既有日语VQA基准进行两轮人工系统化精炼,集中修复“问题歧义、标注错误、无需视觉即可作答”等导致评测失真的数据缺陷;构建JAMMEval以提升评测可靠性,并实证其带来更低的重复运行方差、更强的模型区分度与更贴近真实能力的得分表现,同时开源数据与代码以促进日语VLM可复现实证评估。
- [2026-04-06] Rethinking Model Efficiency: Multi-Agent Inference with Large Models 🆕NEW
- 赛道归属: 推理优化 / 高效推理(多智能体推理、token效率)
- 核心创新点: 从端到端延迟分解出“输出token数”是VLM推理瓶颈之一,并提出反直觉结论:大模型若能用更短输出可比小模型长输出更高效;据此提出多智能体推理框架——默认使用“大模型短回答”以降低生成开销,在需要更强推理时复用/迁移“小模型产生的关键推理token”,以接近大模型自带长推理的效果并兼顾效率。
- [2026-04-06] Vero: An Open RL Recipe for General Visual Reasoning 🆕NEW
- 赛道归属: 多模态推理强化学习 / VLM后训练(RL配方与数据)
- 核心创新点: 提供可复现、全开源的视觉推理RL训练“配方”:汇聚59个数据源构建600K规模的Vero-600K,并用“任务路由奖励”统一处理跨任务、异构答案格式;在30项挑战基准上系统验证RL数据覆盖面与奖励设计对泛化视觉推理的关键作用,证明无需专有“thinking数据”也能显著超越同底座开源模型,并通过消融揭示不同任务类别诱发的推理模式迁移性有限,强调广覆盖RL数据是主要驱动力。
- [2026-04-06] ClickAIXR: On-Device Multimodal Vision-Language Interaction with Real-World Objects in Extended Reality 🆕NEW
- 赛道归属: 端侧多模态应用 / XR人机交互
- 核心创新点: 将“控制器点击选物”的显式指代机制与端侧VLM推理结合,形成以对象为中心的XR多模态问答流程,降低仅靠凝视/语音带来的指代歧义;通过ONNX本地推理实现隐私与低延迟优势,并在Magic Leap上落地与云端大模型方案进行用户研究对比,从系统层面验证“端侧+可点击对象选择”在可信交互中的可行性。
- [2026-04-06] Beyond the Global Scores: Fine-Grained Token Grounding as a Robust Detector of LVLM Hallucinations 🆕NEW
- 赛道归属: 多模态幻觉检测 / 可解释性与可靠性(token级grounding)
- 核心创新点: 指出全局相关性度量会被“弱但分散”的伪相关掩盖,导致幻觉token逃逸检测;提出基于patch级细粒度token grounding的检测框架,跨层分析token-区域交互,归纳幻觉的两类结构性特征(注意力弥散不聚焦、与任一区域缺乏语义对齐),并用轻量统计特征结合隐层表示实现可解释的token级幻觉判别,在检测精度上显著提升。
- [2026-04-06] The Blind Spot of Adaptation: Quantifying and Mitigating Forgetting in Fine-tuned Driving Models 🆕NEW
- 赛道归属: 自动驾驶多模态 / 适配与持续学习(灾难性遗忘缓解)
- 核心创新点: 首次系统化量化“驾驶场景微调导致VLM世界知识遗忘”的问题:构建18万场景的大规模基准用于评测遗忘;提出Drive Expert Adapter将适配从权重空间转移到prompt/专家路由空间,通过场景线索动态选择不同知识专家进行推理,在提升驾驶任务表现的同时避免破坏底座参数,从机制上缓解“任务适配 vs 通用知识保留”的矛盾。
- [2026-04-06] Less Detail, Better Answers: Degradation-Driven Prompting for VQA 🆕NEW
- 赛道归属: 多模态理解 / VQA提示工程与鲁棒推理(输入退化策略)
- 核心创新点: 提出“以退为进”的Degradation-Driven Prompting:通过有策略地降低图像保真度(如80p降采样)并叠加结构化视觉提示(白底mask、正交线、模糊/对比增强等),迫使模型聚焦几何结构与关键线索、抑制高频纹理噪声引发的幻觉;并引入任务分类+工具化提示的组合流程,分别针对物理属性与多类感知错觉/异常场景提升VQA推理准确率。
- [2026-04-06] Discovering Failure Modes in Vision-Language Models using RL 🆕NEW
- 赛道归属: 多模态评测与红队 / 失败模式挖掘(RL自动对抗提问)
- 核心创新点: 用强化学习将“发现VLM盲点”自动化:训练一个提问者智能体根据候选VLM的回答自适应生成问题,以最大化诱发错误;通过逐步提升问题复杂度、组合细粒度视觉细节与技能要素,替代人工枚举弱点的低效流程,最终挖掘出36种新的失败模式,并展示对不同模型组合与分布的可迁移性。
- [2026-04-06] ROSClaw: A Hierarchical Semantic-Physical Framework for Heterogeneous Multi-Agent Collaboration 🆕NEW
- 赛道归属: 具身智能 / 多机器人协作框架(VLM控制、sim-to-real闭环)
- 核心创新点: 提出面向异构多机器人协作的分层语义-物理统一框架:以VLM作为统一控制器贯通语义推理与执行,并利用e-URDF将机器人物理约束显式注入,构建仿真到真实的拓扑映射以实时访问多体状态;同时把真实执行中的多模态观测、状态与轨迹纳入数据闭环,支持迭代式策略优化与跨平台迁移,并在部署时动态分配任务控制权以提升长时序、多策略执行鲁棒性。
- [2026-04-06] InCTRLv2: Generalist Residual Models for Few-Shot Anomaly Detection and Segmentation 🆕NEW
- 赛道归属: 视觉异常检测 / 通用少样本异常检测与分割(VLM语义先验)
- 核心创新点: 在InCTRL“in-context residual”少样本范式上扩展为双分支通用异常检测与分割:主分支DASL引入正常+异常数据学习语义引导的“正常/异常”判别空间,辅分支OASL仅用正常数据学习更泛化的“正常性”语义表征;两分支共同利用大规模视觉-文本模型提供的语义先验,从“区分视角+偏离视角”双重刻画异常,提高跨域泛化与少样本鲁棒性,并在多数据集上取得SOTA。
GitHub
- [2026-04-06] Blaizzy/mlx-vlm ⭐4120
- [2026-04-06] liudaizong/Awesome-LVLM-Attack ⭐526 🆕NEW
- [2026-04-06] Roots-Automation/GutenOCR ⭐180 🆕NEW
- [2026-04-06] OpenGVLab/MMT-Bench ⭐118 🆕NEW
- [2026-04-06] yunncheng/MMRL ⭐102 🆕NEW
强化学习
arXiv
- [2026-04-02] DEFT: Distribution-guided Efficient Fine-Tuning for Human Alignment 📖2 🆕NEW
- 赛道归属: 大语言模型对齐(RLHF高效微调 / 数据选择)
- 核心创新点: 提出DEFT对齐框架,用“差分分布奖励”同时刻画(1)模型输出分布与(2)偏好数据差异分布之间的偏离程度,据此从原始偏好数据中筛出小而高质量的子集,并将该分布引导信号注入现有对齐方法以约束输出分布迁移;在显著降低训练时间的同时,提升对齐效果并缓解对齐导致的泛化能力下降。
- [2026-03-31] Empirical Validation of the Classification-Verification Dichotomy for AI Safety Gates 📖1 🆕NEW
- 赛道归属: 强化学习安全(安全门控/验证与自改进)
- 核心创新点: 系统性实证证明“分类器式安全门”在迭代自改进场景下存在结构性失效:即便训练精度100%、NP最优检验、以及多种安全RL基线也无法同时满足低误放行与可持续改进;进一步提出并验证“验证器式门控”替代路径——基于Lipschitz球的解析可证安全界给出零误放行,并通过ball chaining实现跨越多个安全球的无界参数空间遍历;还给出按组组合验证以显著放大可验证半径。
- [2026-04-06] Stratifying Reinforcement Learning with Signal Temporal Logic 🆕NEW
- 赛道归属: 强化学习理论(STL时序逻辑奖励/表示几何分析)
- 核心创新点: 将信号时序逻辑的原子谓词重新解释为“分层空间成员测试”,提出基于分层理论的STL语义并建立对应原理:多数STL公式可视为诱导时空分层结构;据此把DRL学到的潜在嵌入空间结构与决策空间几何联系起来,并提出可计算、效率较高的分层“签名”用于从嵌入中挖掘分层结构,在以STL鲁棒性为奖励的Minigrid示例中进行数值验证。
- [2026-04-06] Vero: An Open RL Recipe for General Visual Reasoning 🆕NEW
- 赛道归属: 多模态推理强化学习 / VLM后训练(RL配方与数据)
- 核心创新点: 提供可复现、全开源的视觉推理RL训练“配方”:汇聚59个数据源构建600K规模的Vero-600K,并用“任务路由奖励”统一处理跨任务、异构答案格式;在30项挑战基准上系统验证RL数据覆盖面与奖励设计对泛化视觉推理的关键作用,证明无需专有“thinking数据”也能显著超越同底座开源模型,并通过消融揭示不同任务类别诱发的推理模式迁移性有限,强调广覆盖RL数据是主要驱动力。
- [2026-04-06] Analyzing Symbolic Properties for DRL Agents in Systems and Networking 🆕NEW
- 赛道归属: 强化学习可验证性(系统与网络DRL的符号性质分析)
- 核心创新点: 从“点性质”验证推进到“符号性质”分析:提出面向系统/网络DRL策略的通用符号性质形式化(如单调性、鲁棒性),并将其编码为同一策略在“相关输入范围”上的成对执行比较;通过分解为可求解的子性质,使现有DNN验证引擎可直接用于大范围输入区间的性质检查;在三类真实控制系统上用diffRL系统性评估,展示符号性质能覆盖更广状态空间、发现更具操作意义的反例,并量化不同求解器/模型规模的可验证性权衡。
- [2026-04-06] QED-Nano: Teaching a Tiny Model to Prove Hard Theorems 🆕NEW
- 赛道归属: 数学推理与证明生成(小模型RL后训练 / 可验证奖励)
- 核心创新点: 构建4B小模型QED-Nano的可复现训练流水线,以“三阶段后训练”实现奥赛级证明能力:先从强数学模型蒸馏做SFT获得证明文风与基础能力,再用基于评分细则的RL进行可验证偏好优化,最后引入“推理缓存”把长证明拆成迭代的总结-改写循环以增强训练与测试时推理;在显著低推理成本下超过更大开源模型并逼近部分闭源系统,同时开源数据与代码以促进可复现实验。
- [2026-04-06] Rethinking Exploration in RLVR: From Entropy Regularization to Refinement via Bidirectional Entropy Modulation 🆕NEW
- 赛道归属: LLM推理强化学习(RLVR探索机制 / 熵调控)
- 核心创新点: 针对RLVR中“探索受限”与传统熵正则不稳定的问题,从群组相对优势估计(GRPO类)推导熵动态,提出将策略熵分解为“信息熵”(保留有效多解路径)与“伪熵”(破坏推理模式的噪声);提出“熵精炼”观点:对正样本维持信息熵、对负样本抑制伪熵;据此提出AsymGRPO,显式解耦正/负rollout的熵调制,实现更可控的探索-收敛权衡,并在多任务上优于强基线且可与熵正则协同。
- [2026-04-06] Data Attribution in Adaptive Learning 🆕NEW
- 赛道归属: 强化学习理论(自适应学习的数据归因/因果归因)
- 核心创新点: 面向在线bandit/RL/LLM后训练等“自适应数据生成”场景,提出发生级数据归因的形式化目标:用条件干预定义单条观测对最终性能的因果贡献,显式纳入“该观测会改变未来采样分布”的反馈效应;证明仅靠回放侧信息一般无法识别该归因目标,并刻画一类具有结构约束的情形可从日志数据中实现可识别,为自适应训练中的可解释与责任追踪提供理论基础。
- [2026-04-06] Synthetic Sandbox for Training Machine Learning Engineering Agents 🆕NEW
- 赛道归属: 智能体强化学习(ML工程智能体 / 合成环境与可验证训练)
- 核心创新点: 针对MLE智能体在真实环境中“验证成本极高、导致轨迹级on-policy RL不可用”的瓶颈,提出SandMLE:从少量种子任务自动生成多样、可验证的合成MLE沙盒环境,并将数据集压缩到微规模(每任务50–200样本)以保留结构复杂度同时大幅降低训练/评测开销;通过多智能体生成提升任务覆盖与多样性,使大规模轨迹级on-policy RL首次在MLE域可行,并验证其相对SFT在多模型规模上显著提升且能跨脚手架泛化。
- [2026-04-06] Selecting Decision-Relevant Concepts in Reinforcement Learning 🆕NEW
- 赛道归属: 可解释强化学习(概念瓶颈/概念选择与状态抽象)
- 核心创新点: 将“概念选择”提升为可证明的序贯决策问题:提出把概念是否决策相关视为一种状态抽象——移除某概念会否导致把需不同行为的状态混淆;据此提出DRS算法,在候选概念集中自动选择子集,并给出所选概念与最终策略性能之间的界;实验表明可自动恢复人工概念集且性能不降甚至更优,并提升测试时概念干预的有效性,降低对领域专家的依赖。
GitHub
- [2026-04-07] verl-project/verl ⭐20478 🆕NEW
- [2026-04-07] alibaba/ROLL ⭐3051 🆕NEW
- [2026-04-07] radixark/miles ⭐1049
- [2026-04-07] Denghaoyuan123/Awesome-RL-VLA ⭐617 🆕NEW
- [2026-04-07] InternLM/Spatial-SSRL ⭐123 🆕NEW
HuggingFace Datasets
-
[2026-03-27] OpenMOSS-Team/OmniAction
RoboOmni: Proactive Robot Manipulation in Omni-modal Context
📖 arXiv Paper (Accepted to ICLR 2026 🎉) | 🌐 Website | 🤗 Model...
由 Research Daily 自动生成 生成时间: 2026-04-07 03:58:16