← 返回首页

内容安全审核说明

生效日期:2026 年 8 月 14 日 | 更新日期:2026 年 8 月 14 日

本说明旨在向您披露「学习之路」服务(以下简称"本服务")在内容安全方面的审核机制。本服务高度重视内容安全与合规,在技术层面通过「平台侧安全能力 + 提示词层约束」的双层机制,尽可能防范违法违规内容在访谈过程中产生与传播。

一、防护机制总览

层级机制作用
第一层:平台侧大模型服务商(DeepSeek)内置内容安全审核对涉政有害、色情低俗、暴力恐怖、违法违规等内容的识别与拦截
第二层:提示词层系统提示词约束访谈顾问的行为规范引导 AI 聚焦业务话题、拒绝不当请求、不输出违规内容
第三层:人工监督项目管理员可查看访谈记录对话可回溯、异常内容可发现并处理

二、第一层:大模型平台侧内容安全能力

本服务的对话与报告生成由国内人工智能服务提供商 DeepSeek 提供技术支持。DeepSeek 模型本身内置了严格的内容安全机制,对以下类别的输入与输出进行识别和拦截:

当用户输入或模型输出涉及上述内容时,模型将拒绝生成相关回复或引导至合规话题。

三、第二层:提示词层约束(本平台主动控制)

在依赖平台侧安全能力的基础上,本服务通过系统提示词(System Prompt)对访谈顾问的行为进行显式约束,进一步规避用户输入与 LLM 输出中的违规内容:

3.1 对用户输入的约束(输入侧)

3.2 对模型输出的约束(输出侧)

四、第三层:人工监督与复核

1. 本服务的管理后台具备完整的访谈记录查看能力,项目管理员可查阅项目内受访者的对话记录与诊断报告,对内容进行复核;

2. 我们保留对服务内容的日常巡查与处置权利,如发现违规内容,将及时采取删除、限制访问等措施;

3. 如您发现任何违规内容或不当输出,可通过本网站管理后台渠道或邮件与我们联系,我们将及时核实处理。

五、关于敏感词拦截的说明

需要如实说明的是:本平台未另行部署独立的本地敏感词拦截库,内容安全主要依托上述双层机制实现:

该机制在业务访谈场景下能够有效防范绝大多数违规内容;同时我们也在持续关注平台安全能力升级,并会根据需要评估引入更严格的本地审核机制。

六、局限性与声明

1. 人工智能内容审核技术仍存在局限性,自动识别可能发生漏判或误判,任何内容安全机制都无法保证绝对拦截所有违规内容;

2. 本服务面向企业组织诊断场景,使用者在访谈中应遵守法律法规与职业道德,不主动输入违法违规内容;

3. 本说明将根据法律法规要求与技术发展适时更新,更新后的内容在本页面公布。

提示:如您在使用本服务过程中发现违法违规内容,请立即停止使用并联系我们,我们将依法依规及时处理。