稀宇科技(MiniMax)近日正式推出其首款开源多模态生成模型——MiniMax H3,并计划于近期向公众开放模型代码。这一举措标志着该公司在多模态人工智能领域的技术突破,旨在为开发者提供更灵活、可定制的生成式AI工具。
作为稀宇科技最新研发的成果,MiniMax H3支持同时处理文本、图像、视频及音频四种模态的输入与输出。通过整合跨模态信息,该模型能够生成更自然、连贯的交互内容,适用于虚拟对话、内容创作、智能助手等多样化场景。
据官方介绍,H3模型在训练过程中采用了大规模异构数据集,优化了多模态对齐机制,显著提升了生成结果的一致性与逻辑性。其开源特性将降低技术门槛,推动社区协作创新,加速多模态AI在垂直领域的应用落地。
此次发布标志着稀宇科技从闭源研发向开放生态的战略转型。公司表示,后续将持续更新模型版本,并推出配套开发工具包,以支持开发者快速构建个性化应用。行业分析师认为,H3的开源或引发新一轮多模态AI技术竞赛,重塑生成式AI的竞争格局。