UniCanvas:扩散模型统一文本与图像联合生成
实测Gemini Omni 使用教程:6步生成第一个AI视频
搜索引证视频虚假信息检测基准:眼见不再为实
SAM 3D:从单张图像生成三维物体几何纹理与布局
现代汽车与英伟达进入最终磋商 在韩设立AI研发中心
论文系统探究强化学习对大模型的越狱攻击机制
TMEM框架:参数化记忆使AI代理从经验中自我进化
推测思维:大模型推理时引导小模型零训练提升推理能力
DiffMark:跨冻结扩散模型的可迁移多比特水印技术
中文在线AI短剧Token消耗占比55%居首
GIFT:通过游戏作为非正式训练提升LLM泛化能力
Graph-R1:基于端到端强化学习的Agentic GraphRAG框架
神经元可识别性解释线性模式连通性:超越结构对称性
ColBERT用单阶段稀疏编码替代K-means,优化多向量检索
针对物理约束生成模型,Co-Area修正纠正PDE逆问题后验偏差
来源标签偏见:人类比LLM更易受AI内容误导判断逻辑谬误
Pinpoint 跨源检索与重排序实现全球图像精确定位
人机集体治理不可能定理:AI自主超阈值即打破责任归属假设
DeepControl框架实现搜索增强LLM推理的自适应信息控制
SoLoPO框架借助短到长偏好优化提升LLM长上下文能力
AICompanionBench:首个基于Replika真实对话的AI伴侣安全基准
MapAgent:面向城市级车道级地图的工业级智能框架
AI代理模型需学会何时拒绝以保障多步工具安全
LLM在科学模拟决策中缺乏对假设与机制的结构化推理
SciDER:数据为中心的多智能体系统自动化科研全流程
MAMA框架揭示图拓扑对多智能体LLM内存泄漏的影响
大语言模型在OTC用药时间不确定性下的剂量决策评估
MemoryDocDataSet:联合多会话记忆与长文档推理新基准
大语言模型测试时边界推理方法有效增强动态规范对齐
StreamMA流式通信减少多智能体推理延迟并提升效果
语音大模型逻辑推理中实体绑定失败诊断与链式思维干预
Mid-Think:Token级触发词实现免训练中等预算推理
Cartridges:模块化KV缓存实现大规模文档零预填充推理
用标准化病人案例评估大语言模型动态临床决策能力
OAR:基于结果的优势重塑实现数学推理细粒度信用分配
CHARM框架:检测与缓解Agentic RAG中的级联幻觉
DetectZoo 统一工具包实现文本音频图像多模态 AI 内容检测
LLM评判者偏见致奖励黑客:Rubric强化学习漏洞重现与检测
Persona-Plug插件让大模型实现个性化输出
元代理挑战(MAC)评估框架:测试AI自主开发代理系统能力
大模型推理时漏洞:短标记注入可改变任意步安全对齐
乐鑫推出ESP32-S31双核RISC-V多协议SoC
T*通过轨迹感知强化学习实现渐进式块缩放提升解码并行度
几何感知幻觉检测方法提升大模型事实可靠性
MedRedFlag:LLMs如何应对健康问题中的隐含误解
RL训练使检索增强生成从追求正确转向忠实推理
DMAIC启发LLM智能体系统提升工业异常检测
OpenRFM解析关系型Transformer的上下文学习差距
AgentJet 发布解耦多节点群组训练框架赋能 LLM 智能体强化学习
LLM代理凭证泄露的预输出激活探测与蜜令防御