紫东太初

分类
AI聊天助手
收录时间
2025-12-06

简介

中科院自动化所多模态大模型,网页端可直接对话,支持图文音、视频与3D点云理解。

详细介绍

紫东太初是中国科学院自动化研究所与武汉人工智能研究院联合研发的多模态大模型,网页端的运营主体为中科紫东太初(北京)科技有限公司,官网首页标注的版本已经到4.0。 版本脉络上有两个公开节点。2021年7月发布的1.0是国内首个千亿参数的三模态模型,同时处理图像、文本与语音;2023年6月的2.0把输入范围扩到视频、3D点云和雷达信号,官方称之为全模态。技术底座走全栈国产化路线:算法由自动化所自研,硬件与框架使用昇腾AI和昇思,算力依托武汉人工智能计算中心。 官网列出的一组对标数据(官方口径):中文推理能力达到GPT-4o的95%,中文写作高出3%,上下文长度支持128K。视觉侧,中文视觉对话高出GPT-4o 2%,OCR类任务高出3%。图文音混合理解比Gemini-1.5-pro高出6%。任务规划方面,简单任务比GPT-4o高出5%,并支持图文音同步调度。这组数字的测试条件未公开,横向比较时留有余地。 入口有两条。普通用户在官网首页点「立即对话」进入网页版;官网写明账号需注册并经审核通过,登录后可以上传图片、视频、点云、音频、音乐与信号文件,围绕文件内容提问。开发者走MaaS平台ai-maas.wair.ac.cn申请API Key,把能力接进自己的应用,另有大模型开放服务平台提供零代码的微调与模型发布。 合规与落地有公开可查的记录:2023年8月,紫东太初进入首批《生成式人工智能服务管理暂行办法》备案名单。由中科院自动化所牵头的多模态人工智能产业联合体成员单位近70家,公开报道的落地领域包括手语教学、法律咨询、交通出行、医疗机器人与医学影像判读。