长三角安全人工智能实验室发布三大AI安全方案

IT时代网9月20日消息,第一届中国网络空间安全大会(CCSC 2026)的人工智能安全与应用治理论坛在安徽合肥举办。作为承办方之一,长三角安全人工智能安徽省实验室现场发布星界、星驭、星鉴三大AI安全解决方案,覆盖大模型内容安全、智能体应用安全与AIGC生成内容传播可信。

星界面向大模型全生命周期,提供覆盖数据构建、模型训练、应用上线与持续运营的一体化内容安全治理能力。从源头通过训练数据清洗、安全价值对齐与模型安全增强降低内生风险;应用运行中通过内容安全护栏实时识别与处置提示词攻击、违法违规内容等风险;持续运营中则通过风险监测与人工研判实现快速干预与闭环优化。

星驭面向各类智能体应用,以身份与权限管理为底座,明确智能体执行主体、授权关系与操作边界。上线前通过Skill安全检测识别供应链风险,并在安全靶场中通过自动化红队测试验证真实执行风险;运行中覆盖输入、规划、执行全过程,对提示词注入、工具滥用、越权操作、敏感信息泄露及任务失控等风险进行监测与分级处置,事后通过日志回放与全链路审计支撑复盘溯源。

星鉴面向AIGC内容传播与治理,覆盖文本、图像、音频、视频四大模态,通过内容标识与数字水印为AI内容建立可验证的数字身份;针对来源不明的内容,结合AI生成检测与有害内容识别,研判内容违规风险,贯通内容标识、检测核验与来源追溯,可用于AIGC创作、内容平台、新闻媒体及社交传播等场景。

该实验室由安徽省人民政府批准,依托安徽星盾智能科技有限公司建设。实验室主任刘俊华在会上表示,实验室在内生安全上从数据源头构建大模型价值对齐体系,同时持续建设和完善评测体系,为大模型内容和智能体安全搭建安全防护体系。

注:本文中包含AI辅助创作的内容。

编辑:林一舟

THE END