ProtoT:用原型替代自注意力的线性成本可解释语言模型
多阶通信MOC:突破LLM多智能体系统消息感受野限制
MemGraphRAG: Memory-based Multi-Agent System for Graph Retrieval-Augmented Gener
Monitoring Agentic Systems Before They're Reliable
MulFeRL: Enhancing Reinforcement Learning with Verbal Feedback in a Multi-turn L
状态跟踪任务扩展推理失效,工具委托成必要
几何潜在推理方法显著缩短大语言模型生成文本长度
结构视角揭示大语言模型多语言处理的内在机制
LLM价值权衡受性别线索影响?RVDB基准测试给出证据
AXIOM:信任优先的神经符号执行架构实现可验证数学推理
PMC-InterCPT:生物医学交织数据重构多模态持续预训练
训练提示词决定微调效果:状态自适应优化提升大模型鲁棒性
MENTIS方法:测量语言模型对齐后的内部多尺度潜在扭转
EvoNote:基于经验记忆自我进化的LLM代理生成健康社区证据纠错笔记
WaveFilter:用小波引导KV缓存过滤提升扩散LLM长上下文能力
论文提出双粒度偏好学习实现Agent技能选择性调用
LaSR:基于潜在推理的上下文感知语音识别
混合验证解码:LLM推测解码中验证分配的优化
大语言模型内部先验限制零样本注释任务适应性
字节跳动Bernini-R图像文本转视频模型
分布对齐自蒸馏:动态Token选择提升推理鲁棒性
Nvidia 发布 GR00T-H-N1.7 机器人基础模型
SALSA提出监督学习转向向量实现语音感知LLM自适应
OCC-RAG:面向忠实问答的最优认知核心小语言模型
软提示技术实现大语言模型幻觉轻量级缓解
MemPro:将智能体记忆系统设计为可进化程序
NVIDIA发布Cosmos3 Nano策略模型DROID版本
多智能体LLM辩论立场趋同三源分解:自发、从众与推理说服
SPADER:多样感知探索奖励的逐步同行优势用于多答案问答
Momento基准评估多会话代理持久记忆与推理能力
大语言模型个性化共情:根据用户性格调整共情策略
D3IM:采样器匹配训练实现掩码扩散语言模型的自纠正
在线自蒸馏:强化学习策略内部化温度防熵坍塌
自进化语言模型推理在封闭场景下的泛化差距研究
LUNA:语言学自适应单token无失真大模型水印
PillarDETR:YOLO骨干结合RT-DETR头实现实时3D目标检测
多模态动作扩散实现鲁棒端到端自动驾驶
arXiv论文提出高效RAG:意图感知检索与语义保持分块
Mamba-2状态汇:单桶探针仅捕获少量执行层,遗漏大半检测层
HarnessForge提出联合策略与执行框架实现智能体系统自适应演化
CA-BED对话感知贝叶斯实验设计优化LLM主动信息获取
HypothesisMed:推理时答案融合与结构化假设空间报告用于生物医学问答
后训练推理数据入门:综述150余篇文献揭示工作原理
大模型局部约束解码偏差缓解:可处理提议与序贯蒙特卡洛方法
LLM异步规划借助自动形式化:三新基准填补执行时序约束空白
大模型引发论点坍缩,公共辩论趋于扁平化
共振上下文锚定:解耦注意力路由与信号增益消除LLM上下文忽视
CRAM:质心路由与自适应MoE实现多模态持续指令微调
SkillHarm揭示AI Agent技能全生命周期安全漏洞与攻击面
新研究提出子模块替换压缩,突破LLM压缩层粒度限制