文章主要内容总结本文围绕香港首个主权大语言模型HKGAI-V1的开发展开,核心内容包括:开发背景与目标:针对香港“一国两制”下独特的社会法律环境、多语言需求(粤语、普通话、英语)及本地文化价值观,构建符合区域特性的主权AI基础设施,以实现AI在公共服务、法律、教育等关键领域的自主可控。技术基础与架构:基于DeepSeek架构,通过全参数微调实现与香港区域规范的系统对齐,并整合检索增强生成(RAG)系统确保信息的时效性和事实准确性。系统架构包含设计原则(可扩展性、多层安全、用户中心等)、智能体工作流(规划、执行、交互)及核心层组件(信任治理层、平台服务层等)。价值对齐方法:采用强化学习从人类反馈(RLHF)、语言反馈学习(LLF)、弱到强泛化(weak-to-strong generalization)等技术,结合本地标注数据集(如Q-A-C数据集)训练价值校正模型HKValue-Aligner,确保模型与香港伦理、法律标准对齐。评估与性能:通过多个基准测试验证模型性能,包括:在HKMMLU(香港多任务语言理解)基准上创最佳表现(81.4%准确率,远超DeepSeek-V3的76.6%);在Beaver-zh-hk(香港安全基准)上的无害性得分(88.95)显著高于DeepSeek-R1(70.41);在SafelawBench(法律安全基准)上平均准确率达80.0%,竞争力强。