思源大模型的诞生背景
思源大模型是厦门大学纪荣嵘教授团队历时十年研发的成果,旨在打造自主可控、拥有全国产化知识产权的基础大模型。其研发初衷源于对人工智能技术自主发展的重视,尤其在ChatGPT-3发布前,团队已着手相关研究,以应对未来技术竞争的格局。
技术特点与训练方式
思源大模型以“紧致化多模态”为核心理念,能够处理文本、图像、音频等多种数据类型。其预训练语料达1万亿token,覆盖了人类知识的大部分内容。此外,团队通过2500万条高质量垂直数据进行持续训练,提升模型的交互与应用能力。
应用场景与行业价值
思源大模型已在智慧政务、企业服务、边缘计算等领域落地应用。例如,在政务窗口中,它能通过自然语言理解普通话和方言,为市民提供表格填写指导与信息审核服务。同时,其轻量化部署方式使得中小企业也能以低成本使用该技术,推动人工智能在东南沿海地区的产业创新。
未来发展方向
思源大模型团队正致力于将技术进一步应用于更多垂直领域,助力厦门构建人工智能创业孵化生态圈。通过优化模型结构,团队实现了在保持功能不变的前提下降低使用成本,为AI技术的普及与落地提供坚实支撑。