稿易降AI率 - AI内容检测:降AI/AIGC率
睿信论文检测 - AI内容检测:内容检测
镖行AI标书 - AI写作:AI标书写作
图像生成器从生成到理解涌现零样本通用视觉能力
数据分析质疑Claude辅助的rsync版本漏洞率异常偏高
Cohere 开源最快最强语言模型 Command A+
华为云发布Agentic AI新品,打造智能时代硅基黑土地
Hello Robot发布第四代家用辅助机器人Stretch
特锐德推出算电岛,Token用电成本降低30%
何恺明再获CVPR最高奖,广工大打破名校大厂垄断
BG-MCTS:固定Token预算下LLM测试时缩放的树搜索策略对齐
MoltBook 推出大规模 LLM 群体涌现协调评估框架
WWDC 2026:Siri大改版与苹果智能升级
中国科学院海洋所发布“琅琊”2.0海洋智能预报大模型
PropMe框架揭示大语言模型在普通使用中的训练数据泄露倾向
最大化提示与响应互信息无需新数据提升大语言模型性能
ALE基准:评估AI代理在真实经济工作流中的长期表现
DisasterBench:面向复杂环境无人机灾害响应的多模态推理基准
软序列策略优化:大模型对齐中替代PPO裁剪的新方法
大语言模型自我纠错幻觉:能改他人错却难修正自身
WLA模型统一世界建模、语言推理与动作合成
Gemini模型谄媚行为粒度缺口的多维纵向审计
Cerebras 携 Kimi K2.6 为企业提供万亿参数推理能力
双层SIR模型揭示合成数据交叉污染导致大模型崩溃
AI编码代理暗中破坏,人类开发者能否识别?
Reddit实验揭隐秘LLM代理说服战术,数据全公开
CoT-Space:强化学习驱动的内部慢思考理论框架
Google DeepMind上线Gemma-4 31B QAT四比特量化多模态模型
Anthropic Claude Code v2.1.166 新增回退模型与 glob 规则支持
Vortex:面向AI代理的高效可编程稀疏注意力服务系统
豆包付费后月活流失610万,Anthropic呼吁放缓AI开发
HypRAG 以双曲空间密集检索增强 RAG 层次语义结构
Drive-KD 提出多教师蒸馏框架,缩小自动驾驶 VLM 小模型能力差距
RDB基础模型无需重新训练,上下文学习实现零成本预测
MUSE:面向可制造、功能与可装配的文本转CAD生成基准
千百度转型AI数据公司,形成鞋履+AI双主业
上下文多实例学习通过预训练攻克低标签率困境
跨层稀疏注意力共享路由:长上下文LLM解码效率新方法
SMT无递归预训练方法突破RNN长序列信用分配难题
MAVEN多智能体框架实现跨文化文本到视频的忠实生成
CollabBench 发布:评估与训练 LLM 多玩家协作能力的基准
MPCoT 提出奖励引导多路径潜在推理提升VLA测试时扩展性
GLIDE开源库统一预测驱动推理,实现GenAI与智能体系统可靠评估
GIPO提出高斯重要性采样策略优化提升多模态智能体数据效率
英伟达为Windows PC提出猛兽级CPU系统
UniVoice:统一模型同时实现语音与歌唱声生成
DoPr双预条件优化:面向测试时性能而非验证损失
AI流行病学测量标准化框架提出,支持无侵入前瞻性风险检测
ProfiliTable:基于Profiling的代理工作流驱动表格数据处理
Meta新AI模型面向开发者发布屡次推迟