苏州登临科技股份有限公司自主研发的GPU+架构已实现对MiniMax H3的适配。2026年8月3日,MiniMax正式开源新一代通用视频模型MiniMax H3。该模型能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒、带有原生立体声音频的视频。

01适配MiniMax H3
提供超低成本部署方案
MiniMax H3是一个通用型全模态生成系统,在Artificial Analysis榜单中视频编辑能力排名第一。
MiniMax H3系统由H3-Context-IR、H3-Base、H3-Regenerate-2K三个模块组成,它能够统一理解由文本、图像、视频和音频构成的多模态上下文,并可生成最高2K分辨率、最长15秒并带有原生立体声音频的视频。而这得益于MiniMax H3在预训练阶段就已具备广泛的多模态上下文理解与生成能力,因此能出色地遵循复杂的多模态指令。
目前登临的KS38/ KS58云端推理卡,在业内首次实现单机支持32个独立视频生成应用运行,在释放MiniMax H3完整能力的同时,极大摊薄了单用户的硬件成本,降低进入门槛;同时GPU+架构带来的极致能效,更让持续运营中的电费开支显著缩减,为长期盈利铺就了绿色坦途。
这不仅能够吸引更多个人开发者与 OPC 创新企业加入视频生成领域,更能尽享前沿视频生成模型带来的发展红利,助推生态繁荣壮大。
02GPU+架构:效率与通用的完美融合
重新定义算力效能
登临科技的 GPU+架构 是其核心技术优势所在,它巧妙地融合了传统 GPU 的 通用性 与 ASIC 的 高效率 ,为大模型推理等 AI 应用提供了从算力到能效的全面解决方案。
·卓越能效比,降本增效的关键
登临 GPU+架构通过创新的可扩展、软件定义的片内异构体系结构,实现了能效比的大幅提升,在算力需求暴涨的今天,能源消耗成为算力扩展瓶颈的趋势愈发明显,GPU+架构正是解决这一困境的钥匙。
·高度生态兼容性,降低迁移门槛
登临硬件兼容 CUDA/OpenCL 等现有软件生态,算法模型可平滑迁移,极大节约了企业的移植成本和开发周期。在大模型领域,登临软件栈更是在Day0适配了MiniMax、DeepSeek、Kimi、GPT-OSS等国内外主流大模型。
·强大算力与内存支持,超长上下文处理
登临纳适 系列加速卡提供了高达560 TOPS 的云端有效AI算力,以及 128GB 的大显存配置,为大模型推理和超长上下文提供基础支撑。
·全栈国产化与自主可控,保障供应链安全
登临坚持自主创新,核心IP(架构/微架构/算术单元等)全自研,已申请国内外各类知识产权 200 余项。其产品支持 Windows10、Linux、麒麟等系统,并兼容各类国产 CPU,确保了从硬件到软件的全国产化能力,为客户提供了安全可靠的算力底座。
展望未来,登临科技将持续深化在大模型领域的技术创新与行业应用,致力于推动 AI 视觉与大模型的深度融合,优化 AI 模型部署与优化门槛,拓展全场景 AI 应用,为各行业的智能化升级提供更高效、更智能、更安全的算力解决方案。
关于登临科技
苏州登临科技股份有限公司是国内首个实现规模商业落地的 GPU 企业,专注于高性能通用 GPU 研发与应用。以 “GPU+” 为技术核心,为大模型计算,推理云,智慧城市,智慧工业,AIPC等领域提供高效、通用、安全的算力解决方案,致力于成为 AI 产业化落地的关键算力基础设施提供者。