MLCommons Chakra:标准化执行轨迹赋能AI基准测试与协同设计
SEGS 提出结构能量引导采样解决文本到3D生成的视角不一致问题
HAVEN分层对齐多模态基准统一视频理解评估
异构感知数据集调度实现音频大语言模型高效训练
小语言模型的可执行推理支架评估:CGR协议
昆仑万维发布Matrix-Game-3.0图像文本转视频模型
百川智能发布Baichuan-Omni-1d5全模态基础模型
特朗普推迟AI安全行政令,称原语言或成阻碍
智源发布RoboBrain2.5-8B-MT多模态模型
Dr.LLM动态层路由:按需分配计算深度提升效率
MTraining分布式动态稀疏注意力实现超长上下文高效训练
Mega-ASR以规模化真实声学模拟突破语音识别鲁棒性瓶颈
STAR-PólyaMath多智能体推理框架解决长时推理可靠性瓶颈
真实世界自回归Transformer图灵完备性依赖上下文管理
STAR-PolyaMath多智能体框架攻克长时数学推理可靠性难题
HalluWorld:基于参考世界模型的幻觉评估基准提出
FormalASR端到端模型实现中文口语直转正式文本
IBM Granite Speech 4.1-2B Plus多语言语音识别模型上线
IBM Granite 311M多语言嵌入模型发布,支持ONNX/OpenVINO
apple/Sharp
一步扩散模型实现真实世界时空视频超分辨率
低计算水印移除新方法:双域自然投影平衡三目标
PhysX-Omni统一框架生成刚体、可变形与关节物体的仿真就绪3D资产
FRED多模态自动驾驶数据集:专攻洪水路面场景
IBM 发布 Granite Switch 4.1 3B 文本生成模型预览版
面壁智能首个Release发布,支持MiniCPM多模态模型及Intel显卡加速
IBM发布Granite Embedding多语言嵌入模型311M支持多种格式
IBM开源Granite Switch 4.1-8B预览文本生成模型
IBM Granite 发布多语言语音识别模型 granite-speech-4.1-2b
Mistral-inference v1.1.0 新增 LoRA 模型推理支持
SWE-MiniSandbox:无容器强化学习训练软件工程智能体
Mistral v1.10.0 带来 Tokenizer v15、推理能力与 Python 3.14 支持
InternLM-v0.2.0发布,支持流水线并行与序列并行等特性
InternLM v0.2.0 新增流水线与序列并行及评估功能
InternVL-Chat-V1.2 发布:借鉴 LLaVA-NeXT 的多模态对话模型
可证明保护微调LLM免受训练数据提取并保持效用
IBM Granite Vision 4.1-4B视觉语言模型正式开源
增量秩1联想记忆专家混合实现无遗忘持续学习
OLMo研究揭示性别偏见从预训练数据到对齐的传递路径
Event-Aware Prompt Learning 让动态图学习感知历史事件
SPECTRA提出频谱域感知图生成方法应对分子性质回归数据不平衡
CEDAR:通过自适应旋转实现视觉语言模型嵌入的稀疏解耦
Open-Sora 1.1发布:支持0-15秒视频、144p至720p多分辨率
HuggingFace TRL v1.4.0 分块交叉熵损失降低 SFT 显存消耗至多50%
LCGuard:多智能体系统KV共享的潜在通信安全防护方案
X-OmniClaw发布统一移动智能体技术报告,支持多模态理解交互
重尾引导的大语言模型逐层学习率方案
HuggingFace PEFT v0.19.0 发布九种新微调方法
优化器诱导谱缩放定律:同架构FFN不同容量
对抗蒸馏中鲁棒教师为何失败:置信度错位机制揭示