TTT与KV绑定实为线性注意力机制的形式化重释
Deep Delta Learning:Transformer残差层选择性重写机制
Agent² RL-Bench 评测:LLM 智能体自主完成强化学习后训练能力
扩散模型突破约束:基于RL与MCTS的序列自回归生成
Zatom-1:统一分子与材料3D建模的跨领域多模态基础模型
HiddenBench基准揭示多智能体LLM分布式信息下集体推理系统性失败
arXiv论文警告:自动化AI对齐可能产生误导性安全评估
FOAM:分块状态折叠实现LLM训练内存优化
HLA高阶线性注意力:突破一阶限制的因果流式交互机制
GUIGuard-Bench提出通用隐私保护GUI代理评估基准
扩散模型约束失效,自回归生成结合RL与MCTS突破限制
THINKSAFE 以自生成安全对齐解决推理模型过度服从风险
异步推理实现大语言模型无训练交互思考
CodeClash:目标导向软件工程编码基准
通过流形投影改进流匹配的无分类器引导
FOAM提出分块状态折叠法降低LLM训练内存占用
B站研究揭示AIGC规模主导内容生态,用户偏好退居次位
LADD 提出潜在增强离散扩散,在联合空间扩散提升少步生成
最优控制视角下的流图奖励引导少步对齐方法
PBT-Bench:评估AI智能体属性测试能力的专属基准
地球科学基础模型:从感知到推理与科学发现
检索增强多智能体框架实现医疗对话系统自动化可靠评估
层间几何结构优化LLM最终表示方法
Transformer学习语义关联的机制:梯度主导项带来可解释性
Deep Delta Learning:Transformer残差流的选择性改写机制
研究发现TTT与KV绑定架构本质上等同于线性注意力
Predict-Project-Renoise:迭代投影再噪化实现扩散模型硬约束采样
三十字提示即可诱使GPT等12款大模型推荐高价赞助商品
GUIGuard-Bench:面向GUI代理隐私保护的通用评估基准
BlitzGS索引奇偶分片实现城市级高斯泼溅闪电重建
Mistral AI 推出 Medium 3.5、远程编码代理及 Le Chat 工作模式
MXFP4量化引发Llama 3.1-8B全流水线FP4训练发散
异步推理:LLM无需训练即可实时交互思考
流匹配无分类器引导的流形投影优化方法
地球科学基础模型:从感知推理到科学发现
梯度主导项揭示Transformer学习词元关联的机制
Loopholing新机制确定性绕过离散扩散模型采样墙
Zatom-1:统一生成与预测的跨领域3D分子材料基础模型
利用层间几何结构聚合LLM中间层提升最终表示
三十个Token用户提示即可让十二款大模型赞助推荐失效
Groq与英伟达达成推理技术许可,加速全球AI推理部署
Databricks推出KARL企业知识代理,采用自定义RL加速
Suno v5.5发布:带来声音克隆、自定义模型与个性化推荐
硬约束扩散模型采样新方法:预测-投影-再噪声化
BlitzGS分布式框架用索引奇偶分片加速城市级高斯泼溅重建
Realtime-VLA FLASH:推测推理框架加速扩散式VLA实时部署
Databricks发布基于自定义RL的企业知识代理KARL
Anthropic 瞄准小企业主,AI 平台战事下沉至 3600 万商户
国产GPU联手SGLang等核心开发者,组建开源生态联盟
Runway AI 发布多模态视频模拟器及创意代理 Agent