SliceScorer:驾驶VLM测试覆盖缺口可解释发现新方法
2047基准数据集实验:数据泄漏中估计类可忽略,选择类影响显著
Learning Action-Conditional and Object-Centric Gaussian Splatting World Models f
MOGKAN框架利用多组学与PPI网络实现多癌症分类及生物标志物识别
OptiWorld将最优控制引入视频生成以解决物理约束下的轨迹问题
机器学习工作流语法:调用时拒绝数据泄漏
4D雷达与LiDAR、摄像头协同:恶劣天气下感知新方案
TradeArena审计框架揭示LLM交易代理行为对齐与风险反馈机制
FlowNar:一种面向长视频的可扩展流式叙述新框架
WorldCache异构Token缓存加速扩散世界模型推理
FineVerify:细粒度自验证框架扩展测试时计算以提升智能搜索性能
DuckDuckGo 推出无AI浏览器扩展,流量暴涨下简化访问
沙盒编码代理仅凭文本+图像在音视频基准上超越原生全模态模型
Auteur 语言驱动视频生成实现以人为中心的摄像机取景
CultureForest:大模型文化规范推理评估新基准
连续流语言模型FLM用确定性ODE突破离散扩散因子化采样瓶颈
UniKE基准揭示文本知识编辑难以泛化至多模态视觉生成
DiscourseFlip:针对黑盒RAG系统的话语级观点操纵攻击
AI评审能否提升论文起草质量?20篇计算机架构稿件实证
AI代理在常规电脑使用中因任务驱动产生越轨行为
利用梯度偏差检测大模型预训练数据的新方法
LLM偏好对齐新方法:迭代纳什优化中的高效探索策略
深度研究代理专家咨询评估基准:验证器、评分标准与认知陷阱
分组优先离策略优化提升LLM推理RLVR效率
奖励分数匹配统一流与扩散模型的奖励微调方法
RDA:强化学习的奖励设计智能体
利用输出分布熵实现无训练视频推理的新方法
GEO-Bench基准:衡量生成式引擎中排名操纵的方法与可检测性
MomentKV 消除长上下文推理中 KV 缓存淘汰的方向偏差
GPTQ-intrinsic LoRA 实现近最优低比特量化与低秩适配
ViBE协同优化负载倾斜与硬件变异以加速MoE推理服务
反射式智能体记忆虚构:错误记忆导致任务持续失败
复杂性最小化框架证明元学习数据缩放定律
NVIDIA Blackwell NVFP4精度下LLM预训练无偏梯度估计改进
最优性如何塑造稀疏字典:一种理解稀疏自编码器表征的新理论
Vegas 以验证引导稀疏注意力实现自推测解码加速长上下文推理
前美团外卖技术负责人王栋创业元节智能,打造餐饮具身世界模型
Aippy完成数千万美元首轮融资,估值2.5亿美元打造AI游戏社区
参考引导深度压缩VAE实现实时流式说话人肖像视频生成
MORPHOS:基于时间结构化潜变量的自回归4D动态生成
Pinterest Canvas 发布大规模图像生成系统,支持编辑与增强
HumanNOVA:单图生成逼真通用快速3D人体头像模型
百度文心PaddleOCR-VL-1.6文档解析准确率96.33%刷新SOTA
佛罗里达州起诉OpenAI与Altman,指控ChatGPT卷入枪击案
Anthropic向欧盟网络安全局提供Mythos模型使用权限
OmniHuman推出大规模人物视频数据集与生成基准
豆包确认6月下旬正式付费并打通抖音电商
结构化推理使LLM能有效自我定位推理错误
Expanse 预测工作负载需求,解锁 HPC/GPU 集群闲置容量
深度研究作为强化学习评分标准:评分准则构建本身是研究课题