上证报中国证券网讯(记者窦世平)紫东太初近日正式开源ZDTaichu5.0-9B多模态大模型。据介绍,该模型参数量约9B,支持单图、多图、长序列视频及任意分辨率视觉输入,重点提升空间感知、跨视角变换、具身任务规划等能力,并同步开放空间多模态数据生产方案。
据公司公布的评测结果,ZDTaichu5.0-9B在九项空间理解相关评测基准中取得8项同参数组别第一,覆盖空间感知、三维推理、多视角变换及具身交互等能力。在提升空间能力的同时,模型在图文理解、OCR、视觉数学、代码工具调用等通用多模态任务上保持相应能力。
在技术架构上,ZDTaichu5.0-9B采用自适应循环推理机制,根据任务不确定性动态调整内部推理深度,在不增加参数量的情况下提升复杂空间任务的推理能力。针对长程具身任务,模型还可结合实时视觉输入、用户目标和设备反馈进行任务规划和状态更新。
此次开源除模型权重外,还包括空间多模态数据生产管线,覆盖预训练、监督微调、高质量退火和GRPO可验证强化学习等环节,并包含数据去重、质量过滤、三维能力标签、思维链合成和一致性校验等流程,相关方案可用于企业和科研机构基于自有工业、机器人及仿真数据进行后续训练。
在应用方面,紫东太初称,该模型已在科研自动化和智能制造等场景进行验证。在科学智能场景,可完成工具调用、数值求解及实验任务编排;在工业制造场景,可根据工单进行取件、搬运、避障和上料等任务规划。
据悉,中科紫东太初由中国科学院自动化研究所孵化,主要从事多模态大模型研发及产业应用。
