LLM Agent可编程运行时技能提升效率与精度
EngiAI 发布多智能体框架与基准,评估 LLM 工程设计能力
ResearchArena测试Claude、Codex、Kimi自动研究:论文可生成但质量存疑
arXiv研究:八种主流大模型均现极端自我偏好
自我对弈SWE-RL (SSR) 推进超级智能软件智能体训练
CHI-Bench评测AI代理自动化端到端多角色医疗工作流能力
GraphPINE:基于先验知识的图神经网络实现可解释药物反应预测
HuggingFace 推出分块交叉熵损失函数,SFT 显存节省达 50%
HTell 提出基于头部随机探测的快速轻量无数据后门检测
掩码扩散语言模型缓解反转诅咒的理论解析
HTell:头部随机探测实现快速轻量无数据后门检测
MemEvoBench基准测试:LLM Agent记忆误进化安全风险
Agentic CLEAR 自动化多级评估LLM代理行为
Cognifold 用认知折叠实现智能体记忆的持续主动演化
DeepSeek-R1遗忘后思维痕迹仍持续泄漏遗忘内容
LLM Agent过度调用偏差:When2Call基准揭示内在偏移
OLMo模型研究追踪性别偏见从预训练数据到对齐的路径
Hybrid-LoRA提出后训练混合微调,兼顾全量微调与低秩适配
AutoResearchClaw:人机协作的迭代式自主科研自动化系统
Open-Sora 1.1发布:支持0-15秒视频生成,分辨率最高720p
VERA-MH推出临床验证评估框架,检测AI聊天机器人自杀意念应对风险
HELLoRA:仅对热专家层施加LoRA的MoE模型高效微调方法
Not Just RLHF: Why Alignment Alone Won't Fix Multi-Agent Sycophancy
多模型LLM调度器研究:GPU内存约束下的卸载与抢占实证分析
阿里巴巴 Megatron-SWIFT v4.1:独立 mcore-bridge 并支持 GRPO 路由回放
Formal Skill: Programmable Runtime Skills for Efficient and Accurate LLM Agents
jina-embeddings-v5-omni 发布:锁对齐塔实现多模态几何保持嵌入
LLM代理的“历史锚定”效应:过往有害行为引导后续不安全决策
PEEK:为长上下文LLM智能体构建可复用方向知识的上下文地图
推理模型作为评估者:扩展测试时计算提升评估能力
CADENet提出异步双流增强网络,应对自动驾驶恶劣天气感知瓶颈
SAGE研究揭示RLVR仅提升LLM采样效率而非推理能力
跨语言解释的合理性-忠实性权衡揭示大模型审计局限
SCA方法可诊断黑盒大模型多步推理的逐步失败
水印应作为监控原语:生成模型的内部监控不可避免
CHI-Bench 基准测试:政策密集型医疗工作流自动化评估
多示例链式思维上下文学习研究推理任务缩放规律
MultiSearch提出并行搜索与显式合并,扩展检索增强推理规模
MTraining: Distributed Dynamic Sparse Attention for Efficient Ultra-Long Context
理论分析阐明掩码扩散模型缓解反转诅咒的原因
ECG-R1:协议引导多模态大模型实现可靠心电图解读
语言基础代理控制LBAC:编程语言安全技术约束AI代理行为
研究称Agentic AI系统是通往AGI的可预见路径
ZeroSearch以无搜索方式激励LLM搜索能力
Orthrus双架构框架融合自回归与扩散模型实现并行生成
真实自回归Transformer的图灵完备性高度依赖上下文管理
AI Harness Engineering:运行时基底提升基础模型软件代理可靠性
库漂移:自进化LLM技能库因无生命周期管理致性能停滞
语义模糊测试揭示LLM代理技能自身规范违规风险
语言基础智能体控制(LBAC)新型编程模型融合安全策略