OpenAI推出Lockdown Mode防范提示注入,但数据泄露风险仍在
RedKnot以头部感知KV复用突破长上下文服务瓶颈
批评引导的异构多智能体推理增强大模型数学可靠性
QRC框架:零样本获取开放知识理解迷因演变
个人AI助手实现相机胶卷视觉问答研究
DiG-Plan 以扩散引导缓解工具图规划早期承诺问题
行动-状态通信:优化多智能体系统通信效率的论文方案
AI评估地理偏见凸显多样性挑战
UNIVID统一视觉语言模型实现视频审核多模态推理与可解释输出
LLMCodec 适配视频编解码器实现大模型权重高效压缩
AI编程助手隐藏成本:人类持续监督与认知过载
ALMANAC发布人类协作动作级心理模型标注数据集
因果定位揭示Qwen3-4B模型时间偏好内部子图
MRAgent 用图记忆主动重建,让 LLM 代理推理摆脱静态检索
Trace2Skill:从执行轨迹归纳可迁移智能体技能
大语言模型微调产生新兴错位,训练中防御方法被提出
Transformer拓扑困境:前馈架构限制动态状态跟踪
RAG系统需超越事实锚定,转向表征多元观点
深圳科学家领衔发布亚洲首个合成细胞十年技术路线图
WPS笔记发布:AI贯穿记录、整理与复用全过程
CLASH 数据集:评估大模型在多视角高风险困境中的判断能力
生物医学世界模型:从静态识别转向动态机制预测
PC-Talk实现音频驱动人脸动画的唇音对齐与情绪控制
大语言模型表达感受实验挑战传统对齐策略
PC层多项式权重预条件助力LLM预训练
Google 推出 Gemma 4 12B QAT 量化模型 支持任意模态转换
搜索时间污染致AI深度研究代理公开基准评测性能虚高
Airbnb CEO Brian Chesky 计划成立新AI实验室
Open-H-Embodiment 数据集发布,推动医疗机器人基础模型发展
BenchAgent协议评估:多智能体对LLM工作流增益几何
苹果批准Poke成为Messages for Business首个AI代理
SUPERNOVA用自然指令强化学习扩展LLM通用推理
国家队领投,百曜科技完成数千万元融资打造AI虚拟细胞
华为云Token大战中另辟蹊径:重健康度轻总量
视觉Hopfield记忆网络挑战Transformer与Mamba范式
AWS发布前沿代理:安全测试与云运维自主化
橡木果“本能驱动”路线,开辟自下而上具身智能新范式
微软推出OpenClaw风格AI助手Scout,集成Microsoft 365系统
微软推出可移植策略文件规范,让开发者精准控制AI代理行为
MiniMax M3实测:74个Logo全识别,还能带你走老黄同款南锣
豆包6月下旬正式付费,加速打通抖音电商
多伦多大学团队展示AI蠕虫可攻击任何联网设备
CoralBay自监督三维CT影像基础模型发布
星尘智能三个月内获超10亿融资,估值破百亿
Anthropic 将 Claude Mythos 安全项目扩展至15国关键基础设施
论文观点:LLM对抗性机器学习毫无进展
卧安机器人OneModel 1.7以隐式通路打通具身智能信息传导断层
视觉语言模型空间推理一致却错误:证据不敏感性
神经场作为世界模型:同构架构保留感官拓扑实现物理预测
Anthropic提交招股书,最快Q4上市