本说明旨在向您披露「学习之路」服务(以下简称"本服务")在内容安全方面的审核机制。本服务高度重视内容安全与合规,在技术层面通过「平台侧安全能力 + 提示词层约束」的双层机制,尽可能防范违法违规内容在访谈过程中产生与传播。
| 层级 | 机制 | 作用 |
|---|---|---|
| 第一层:平台侧 | 大模型服务商(DeepSeek)内置内容安全审核 | 对涉政有害、色情低俗、暴力恐怖、违法违规等内容的识别与拦截 |
| 第二层:提示词层 | 系统提示词约束访谈顾问的行为规范 | 引导 AI 聚焦业务话题、拒绝不当请求、不输出违规内容 |
| 第三层:人工监督 | 项目管理员可查看访谈记录 | 对话可回溯、异常内容可发现并处理 |
本服务的对话与报告生成由国内人工智能服务提供商 DeepSeek 提供技术支持。DeepSeek 模型本身内置了严格的内容安全机制,对以下类别的输入与输出进行识别和拦截:
当用户输入或模型输出涉及上述内容时,模型将拒绝生成相关回复或引导至合规话题。
在依赖平台侧安全能力的基础上,本服务通过系统提示词(System Prompt)对访谈顾问的行为进行显式约束,进一步规避用户输入与 LLM 输出中的违规内容:
1. 本服务的管理后台具备完整的访谈记录查看能力,项目管理员可查阅项目内受访者的对话记录与诊断报告,对内容进行复核;
2. 我们保留对服务内容的日常巡查与处置权利,如发现违规内容,将及时采取删除、限制访问等措施;
3. 如您发现任何违规内容或不当输出,可通过本网站管理后台渠道或邮件与我们联系,我们将及时核实处理。
需要如实说明的是:本平台未另行部署独立的本地敏感词拦截库,内容安全主要依托上述双层机制实现:
该机制在业务访谈场景下能够有效防范绝大多数违规内容;同时我们也在持续关注平台安全能力升级,并会根据需要评估引入更严格的本地审核机制。
1. 人工智能内容审核技术仍存在局限性,自动识别可能发生漏判或误判,任何内容安全机制都无法保证绝对拦截所有违规内容;
2. 本服务面向企业组织诊断场景,使用者在访谈中应遵守法律法规与职业道德,不主动输入违法违规内容;
3. 本说明将根据法律法规要求与技术发展适时更新,更新后的内容在本页面公布。