Mistral v1.1.0 新增 Tekken 与 Mistral-Nemo 支持
Pixtral v1.4.0发布:Mistral模型新增视觉理解能力
阶跃星辰开源Step-3.5-Flash-Base文本生成模型
智源研究院发布Emu3.5-Image图文生成模型
Mistral AI 发布 Mistral Guidance,语法引导模型推理与工具调用
Mistral AI 发布 v1.1.0,支持 Tekken 与 Mistral-Nemo
Meta AI v0.2.0 版本正式支持 Llama 4
阶跃星辰发布Step-3.5-Flash-Base文本生成模型
BAAI发布Emu3.5-Image,实现图文到图像生成
Open-Sora v1.2.0 发布:新增视频压缩网络和Rectified-flow训练
Mistral 推出 Guidance:用 Lark 语法引导模型推理与工具调用
Mistral AI 发布 Pixtral 模型,支持图像理解
xAI Grok-2模型上线Hugging Face,下载量已超4.2万
月之暗面发布Kimi-VL-A3B-Thinking多模态推理模型
字节跳动发布Dolphin-v2多模态文档解析模型
概念中心学习无需硬负样本提升对比模型组合性并保持零样本能力
搜索自博弈:无监督驱动智能体能力边界拓展
高阶朗之万动力学降低扩散模型记忆化风险
LLM驱动MCP物理工作流发现胰岛素递送聚合物
Kimi K25/DSR1模型新增TOKENSPEED_MLA注意力后端加速
Open-Sora 1.0.0 开源发布,高质量视频生成工具开放
Qwen-Image-VAE-2.0 发布:高压缩VAE以全局跳跃连接与合成渲染提升重建保真度
基于树广播的层次语言模型实现可预测缩放定律与推理收益
Open-Sora V1.3发布 升级视频压缩与ST-DiT架构提升生成质量
Open-Sora v1.2.0发布:新增视频压缩网络与整流流训练
RealICU基准:检验大模型对长上下文ICU数据的理解能力
DeepMind发布Gemma 4最强开源模型及AlphaEvolve智能体
MLA注意力后端v0.21.0rc3新增TOKENSPEED_MLA加速DSR1/Kimi K25
RealICU:超越行为模仿的ICU长上下文大模型理解基准
语言模型规模达3.5B参数时推理与真实性从对抗转向协同
Open-Sora 1.0正式版发布:开源高质量视频生成模型面向全民
通义千问Qwen-Image-VAE-2.0高压缩VAE改进重建保真与扩散性
Open-Sora V1.3发布:升级视频压缩与ST-DiT架构,强化图生视频
多模态大模型工具调用非全有益,需自适应选择
Google DeepMind推出Gemma 4最强开放模型与AI协同医生
解耦感知与推理:VLM后训练需突破视觉感知瓶颈
Needle开源26M参数工具调用模型,消费级设备达6000 tok/s
小米EV世界模型:融合重建与生成的自动驾驶统一方案
AWS推出前沿代理,自主执行安全渗透测试与云运维
Toto 2.0 时间序列模型参数扩展至25亿,刷新三项基准
层次语言模型实现可预测缩放定律与推理优势可证明
MLLM工具调用非总有益:自适应机制减少冗余误导
前沿模型排行榜区分度下降,新度量聚焦能力耦合与权衡
语言模型规模相变:推理与真实性从对抗到协同
解耦感知与推理:视觉语言模型后训练性能提升的关键
Toto 2.0 时间序列模型参数扩展至25亿,三项基准刷新纪录
Cohere收购Reliant AI,扩展主权企业AI在生物制药与医疗领域应用
MT Lambda发布国内首个全栈具身智能仿真平台
Cactus开源Needle:26M参数工具调用模型,消费设备运行达6000 tok/s
AWS 推出安全测试与运维前沿代理,实现自主规模化运营