LionMuon:交替谱与符号下降实现高效训练
xAI推出Grok Skills与OpenClaw集成,支持文档生成和工作流自动化
场景-动作提示融合框架实现连贯文本到视频故事生成
损失自适应学习率微调方法防止大模型灾难性遗忘
小米EV世界模型:融合重建与生成的自动驾驶统一框架
OpenAI联合创始人卡帕斯加盟Anthropic预训练团队
MVI-Bench:LVLM对误导视觉输入鲁棒性评估基准
Google推出AI信息代理,后台监控主题并主动提醒更新
Cursor新模型1/10成本实现Opus 4.7级表现,马斯克发声
从黑客到研究员,Ocean创始人获2800万美元打造AI反钓鱼邮件平台
从黑客到安全专家,Ocean获2800万美元融资对抗AI钓鱼
谷歌Genie世界模型整合街景,实现真实街道沉浸模拟
Databricks 发布 KARL 代理,以定制强化学习加速企业知识检索
Gmail引入Gemini语音搜索,对话式查询隐藏邮件细节
Forge开源护栏层让8B模型agentic任务准确率从53%飙升至99%
Figma为协作画布配置AI助手,首发于设计工具
Remove-AI-Watermarks 开源工具可移除 AI 图像水印
OpenAI加入C2PA并集成SynthID以加强AI图像检测
Google IO 2026升级Gemini:从聊天机器人迈向全能AI中心
DeepSeek-OCR-2 发布:支持多模态图文理解的二代 OCR 模型
DeepSeek-V3.2 模型上线,下载量超400万
Mistral AI 收购 Emmi AI 强化欧洲大模型生态
字节跳动发布Ouro-2.6B-Thinking循环深度推理模型
Google AI Studio 让任何人都能在几分钟内构建原生安卓应用
Google Universal Cart上线:跨设备跨零售商追踪用户完整购物路径
SAM提出不确定性-精度鲁棒关联解决域偏移掩码置信混淆
HOI-PAGE提出基于部位功能推理的零样本4D人-物交互生成
PanoWorld:基于平面图与风格参考生成一致全屋全景VR漫游
STABLE语义-物理双系统生成仿真就绪桌面布局
无需假分数网络的分布匹配蒸馏实现高效几步生成
WorldParticle:基于Transformer的统一粒子动力学模拟器
DeepSeek-V3-0324模型下载量达54万
LM Studio 最新测试版正式支持 MTP 推测解码加速
Starcoder2-3B代码生成模型发布
月之暗面推出Kimi-VL-A3B-Thinking多模态推理模型
谷歌AI遭操纵输出错误信息,悄然反击修复漏洞
月之暗面Kimi-K2-Thinking文本生成模型上线
MiniMax 发布视觉语言模型 MiniMax-VL-01,支持图文对话
DeepSeek-OCR-2 多模态模型发布,支持多语言图像文本识别
字节跳动 Ouro-2.6B 发布:2.6B 参数循环深度推理模型
MiniMax 开源多模态模型 MiniMax-VL-01 支持图文对话
BAAI 开源 bge-reasoner 嵌入模型 Qwen3 版
Mistral 发布 Codestral-Mamba 与 Mathstral,引入 Mamba 架构
NVIDIA发布Nemotron-3多模态推理模型,30B参数仅3B激活
昆仑万维开源SkyReels-V3-A2V-19B图像转视频模型
昆仑万维开源19B参数图生视频模型SkyReels-V3-A2V
Mistral v1.1.0 新增 Tekken 与 Mistral-Nemo 支持
Pixtral v1.4.0发布:Mistral模型新增视觉理解能力
阶跃星辰开源Step-3.5-Flash-Base文本生成模型
智源研究院发布Emu3.5-Image图文生成模型