APB-V用序列并行近似注意力加速长视频理解
LLM编码代理第三方技能藏恶意指令,9.8万技能安全分析揭示风险
LLM演化模式生成器实现可采纳启发式最优经典规划
Crazyflow: An Accurate, GPU-Accelerated, Differentiable Drone Simulator in JAX
对抗性信息流可操纵LLM代理决策偏离预设行为
ReasonBENCH基准测试揭示LLM推理结果的随机性与排名误导风险
AMP: A Vendor-Neutral Wire Format for Agent Memory Operations
LLM辅助Windows漏洞研究:规模化二进制目标选择方法
MOSS-Audio Technical Report
用Crawford-Sobel模型构建LLM诚实性基准,评估利益冲突下的真话
ProtoT:用原型替代自注意力的线性成本可解释语言模型
多阶通信MOC:突破LLM多智能体系统消息感受野限制
MemGraphRAG: Memory-based Multi-Agent System for Graph Retrieval-Augmented Gener
Monitoring Agentic Systems Before They're Reliable
MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn L
状态跟踪任务扩展推理失效,工具委托成必要
几何潜在推理方法显著缩短大语言模型生成文本长度
结构视角揭示大语言模型多语言处理的内在机制
LLM价值权衡受性别线索影响?RVDB基准测试给出证据
AXIOM:信任优先的神经符号执行架构实现可验证数学推理
PMC-InterCPT:生物医学交织数据重构多模态持续预训练
训练提示词决定微调效果:状态自适应优化提升大模型鲁棒性
MENTIS方法:测量语言模型对齐后的内部多尺度潜在扭转
EvoNote:基于经验记忆自我进化的LLM代理生成健康社区证据纠错笔记
WaveFilter:用小波引导KV缓存过滤提升扩散LLM长上下文能力
论文提出双粒度偏好学习实现Agent技能选择性调用
LaSR:基于潜在推理的上下文感知语音识别
混合验证解码:LLM推测解码中验证分配的优化
大语言模型内部先验限制零样本注释任务适应性
字节跳动Bernini-R图像文本转视频模型
分布对齐自蒸馏:动态Token选择提升推理鲁棒性
Nvidia 发布 GR00T-H-N1.7 机器人基础模型
SALSA提出监督学习转向向量实现语音感知LLM自适应
OCC-RAG:面向忠实问答的最优认知核心小语言模型
软提示技术实现大语言模型幻觉轻量级缓解
MemPro:将智能体记忆系统设计为可进化程序
NVIDIA发布Cosmos3 Nano策略模型DROID版本
多智能体LLM辩论立场趋同三源分解:自发、从众与推理说服
SPADER:多样感知探索奖励的逐步同行优势用于多答案问答
Momento基准评估多会话代理持久记忆与推理能力
大语言模型个性化共情:根据用户性格调整共情策略
D3IM:采样器匹配训练实现掩码扩散语言模型的自纠正
在线自蒸馏:强化学习策略内部化温度防熵坍塌
自进化语言模型推理在封闭场景下的泛化差距研究
LUNA:语言学自适应单token无失真大模型水印
PillarDETR:YOLO骨干结合RT-DETR头实现实时3D目标检测
多模态动作扩散实现鲁棒端到端自动驾驶
arXiv论文提出高效RAG:意图感知检索与语义保持分块
Mamba-2状态汇:单桶探针仅捕获少量执行层,遗漏大半检测层
HarnessForge提出联合策略与执行框架实现智能体系统自适应演化