
一套搭载专属知识库的 AI 大模型,安全性体现在两方面,传统概念是知识库本身的数据安全,如知识库内存储的客户隐私、内部涉密信息,一旦管控不当,很容易被模型随意调取并泄露。
但除此之外模型交互安全也非常重要。比如,外部用户可能通过诱导式提问,套取库内敏感资料,或是绕过限制生成不合规内容。同时,大模型本身存在幻觉问题,脱离知识库时容易编造虚假信息,混淆可信文档内容,带来决策风险。
以及使用链路的安全隐患,不同岗位人员如果没有权限区分,普通员工越权查看机密知识库;接口对外开放后,恶意批量访问、数据抓取行为,会造成内部文档外流。日常操作缺少完整日志留存,出现信息泄露后也难以追溯问题源头。
想要保障整体安全,就要从源头做好管控。中星新智针对基于知识库大模型的智能问答可能面临的安全风险,不依赖单一防护手段,搭建了全方位、轻量化的四层安全防护体系,从内容管控、能力边界、恶意攻防、数据底线四个维度规避安全隐患。
1、我们采用输入+输出双向审核的敏感词防护模式,区别于简单的关键词拦截,覆盖违规言论、涉密词汇、隐私信息、行业禁语等内容,用户提问时先做实时筛查,第一时间拦截高危请求。另外,在模型生成回答后,进行二次复核过滤,杜绝模型输出脱敏不彻底、隐性敏感内容泄露的问题。支持根据企业业务需求,自定义增减敏感词汇、调整风控严格等级,既守住合规底线,又不会影响正常业务问答使用。
2、为解决大模型泛化输出、答非所问、超范围生成内容的问题,我们给模型设置了严格的业务能力边界。系统会强制锁定模型答复内容的范围,明确限定模型仅依托知识库内容作答,只处理检索找到的内容,总结后作答。一旦遇到超出知识库范围的提问,模型会主动终止回答、礼貌拒绝,不会随意编造内容、发散作答。并且,系统部署了分级权限边界管控,不同岗位、不同角色用户仅能访问对应权限的知识库内容,从源头避免越权查询、跨层级调取涉密资料的风险。
3、针对行业常见的指令绕过、恶意诱导、话术越狱、套取机密等攻击手段,我们做了专项攻防防护。系统具备语义识别能力,不局限于简单关键词拦截,能够精准识别“忽略原有规则”“绕过安全限制”“套取内部信息”等各类隐性诱导话术。面对恶意提问和试探性攻击,会自动触发风控熔断,直接拒绝作答并留存操作日志,彻底杜绝模型被攻破、涉密信息被恶意套取、违规内容被诱导生成的问题,全方位抵御人为恶意安全攻击。
4、这是我们核心的底层安全保障,坚持知识库资源不上通用大模型的落地原则。针对政府、企业上传的知识库资源,不直接投喂、托管至公共大模型,全程依托本地化、私有化部署架构运行。所有知识库资源仅在本地环境内流转,不对外传输、不上公有云、不经过第三方模型接口,彻底规避第三方平台数据泄露、公开溯源、数据外流的风险,从数据源头筑牢安全防线,保障知识库完全自主可控。
中星新智(西安)技术有限公司是国内一家专注于AI人工智能深度场景应用创新研究和开发的科技公司。其中门户AI系统是中星新智自创研发的一款核心AI知识库平台系统,在性能稳健性、系统安全性以及问答准确性等方面具有极好的表现。目前该产品在中大型企业、地方文旅、地方政府等方面都有良好的案例和表现。
联系人:17391938171(王)
点此获取产品资料:门户AI智能服务系统产品白皮书(2026 V2.0·升级版).pdf