风月AI已内置多级内容过滤机制,从源头拦截不当内容。
具体措施:
1、角色设定阶段,系统会对虚拟角色的背景、性格和对话风格做合规校验,违规设定直接驳回。
2、实时对话中,每条消息都会经过敏感词库和语义模型双重审核,涉黄、暴力、政治敏感等内容会被自动拦截或替换为安全回复。
3、用户可主动干预:长按不当回复,选择“举报”或“屏蔽该角色”,系统会优先处理并调整该角色的行为模型。
注意:过滤机制无法做到100%绝对,极端情况下可能漏网。遇到此类情况,直接举报,我们会快速处理。
还有问题点帮助中心的意见反馈入口。