StepAudio 2.5 ASR – 阶跃星辰发布长音频自动语音识别模型
Xiaomi-Robotics-0 - 小米开源的实时视觉语言动作机器人模型
HappyHorse-1.0 – 阿里ATH发布的AI视频生成模型
EAPO - 阿里通义实验室开发的长上下文推理强化学习框架
Step Image Edit 2 – 阶跃星辰推出轻量级图像生成编辑模型
SenseNova U1 – 商汤日日新SenseNova发布的原生统一多模态理解生成模型
腾讯混元开源的手机端低比特离线翻译模型 – Hy-MT1.5-1.8B-1.25bit
Grok 4.3 - xAI出品的强制推理多模态Agent旗舰大语言模型
Qwen-Scope – 阿里通义开源的大模型可解释性和特征分析工具套件
GPT-5.5 Instant – OpenAI发布低延迟多模态大语言模型
字节跳动推出的统一多模态视频生成模型 – Mamoda2.5
MCP-PPT 不是 MCP 插件:拿到 stsang8/MCP-PPT 后该怎么用它
SenseNova 6.7 Flash-Lite – 商汤打造的多模态办公智能体模型
GPT-Realtime-2 – OpenAI发布的实时语音交互与AI智能体模型
GPT-5.5-Cyber – OpenAI发布的网络安全漏洞分析及安全推理模型
GPT-Realtime-Whisper – OpenAI发布的实时语音转写与字幕生成模型
GPT-Realtime-Translate - OpenAI推出的实时语音翻译与多语言对话模型
Ring-2.6-1T – 蚂蚁发布Agent万亿推理模型
StepAudio 2.5 Realtime – 阶跃星辰发布的实时语音交互与AI语音模型
MiniCPM-V 4.6 – OpenBMB开发的端侧多模态视觉理解模型
Xiaomi OneVL - 小米推出的自动驾驶潜空间推理多模态模型
告别 Agent 常驻常耗电:从开源单机到 MSE 统一任务调度的架构演进之路
现在很火的MCP是什么:一文教会你使用和开发
OpenClaw 五层架构设计与解析
实战指南:AI调用成本降71%——借助推理路由终结大模型胡乱开销
OpenAI Tasks API 的使用与集成
Composer 2.5 - Cursor推出的AI Agent编程与代码重构模型
HiDream-O1-Image-Pro – 智象未来发布基于UiT的原生全模态图像生成模型
OpenHuman 对比 OpenClaw 和 Hermes Agent
低代码平台接入 Agent 后 我们踩到的组件 上下文和追问坑
5.29北京:智驭运维 Agentic Ops可观测工作坊限时报名!
Antigravity新系列初体验:Codex直呼内行!
Agent Runtime 九个关键设计:状态外化:上下文压缩与多智能体协同
从书架到浏览器:给 AI 接上了三个真实入口:WeRead:ima:kimi webbridge
Agent循环理论
Qwen3.5-LiveTranslate – 阿里推出实时多语言语音翻译模型
一文讲清 RAG:让 AI 读懂业务知识库的核心方法
Agent 系列(一):Agent 是什么——不只是会调工具的 LLM
RAG 系列(二十四):代码 RAG——让AI读懂你的代码库
视觉 Agent 爬取对比 Playwright 脚本:Browser Use 2026 选型表
LingBot-Video – 蚂蚁灵波科技发布的具身智能视频生成模型
uuoov/ppt-image-share-builder 下载入口:图片页、总览图和 PPTX 承载文件怎么跑通
Robostral Navigate - Mistral AI推出的机器人自主导航模型
LingBot-VLA 2.0 – 蚂蚁灵波科技发布的具身智能机器人基础模型
室内晨光肖像
北极战舰风格的对比
海边夏日人像
幽灵灯塔 风暴海景
六种刺绣 Muse 补丁
华丽孔雀灯罩近景