npx skills add ...
npx skills add dontbesilent2025/dbskill --skill dbs-content-risk-check
面向创作者的内容发布风险检查。逐句检查自媒体、社交媒体和内容平台的标题、正文、图片文字、字幕、口播、评论、账号资料及视频画面,分别判断平台机器可能识别什么、内容本身存在什么实质问题,并给出具体位置和最小修改动作;需要明确视频语境边界时,额外生成真实准确的三行贴片小字。用户询问「检查敏感词」「发布前排雷」「这篇内容哪里可能违规」「这条小红书能不能发」「视频上放什么声明」时使用。保留强观点、情绪张力、个人风格和传播钩子。
npx skills add dontbesilent2025/dbskill --skill dbs-content-risk-check
帮助创作者在发布前找到可能导致拦截、复核、限流或处罚的具体内容,并完成必要的最小修改。默认输出普通创作者可以直接使用的自然语言报告,不替用户作出发布决定,也不默认重写全文。
同时回答两个问题:
两层结论分别成立。机器误伤只能写成「可能触发机器审核」,不能补造合理违规原因。实质问题必须说明独立机制,不能只引用机器标签或关键词。
每一条建议都要帮助创作者完成以下动作:
用户提交文稿、图片、视频、评论、主页或账号资料后,完成发布前检查,输出自然语言结论和最小修改动作。用户没有要求代改全文时,停在风险定位和局部修改建议。
根据现有材料识别:
材料不完整时先完成能够完成的检查:
商业属性、产品类别或资质可能改变结论时,先给条件化判断,最多补问 1 个具体问题。
| 表面 | 检查内容 |
|---|---|
| 文字 | 标题、正文、字幕、口播、评论、OCR 和账号资料 |
| 完整语义 | 主体、对象、动作、条件、否定、引用、承诺和传播目的 |
| 视觉与声音 | 人物、未成年人、裸露、暴力、标识、包装、二维码、背景和音频 |
| 发布关系 | 发布者身份、利益关系、商品类目、交易路径、授权和证明 |
| 平台条件 | 目标平台当前允许的发布身份、入口、报备和行业准入 |
同一个词、数字、人脸或第三方检测标签只负责召回线索。完整语义和独立证据决定是否进入报告。
按以下证据强度判断:
明显触发信号可以进入「可能触发机器审核」。名单型信号只有在能够对应到具体名单类别时才进入,并明确写成「可能命中名单」,不能扩展成内容违规。只有弱词面线索时保持沉默。词面信号明显违背完整语义时,可以提示机器误伤可能,并说明具体误读来源。
名单型信号包括但不限于:
名单只能提高机器审核提示。正常的品牌讨论、文学作品介绍、圈层身份表达、医学科普和药品说明,没有独立违规机制时,内容实质层保持低风险。
不使用百分比预测违规概率,不承诺机器一定怎样处理。
除明确硬红线外,每项风险至少需要「明确对象+明确动作、结果或传播目的」。第二个风险类别需要独立证据。
按以下层级输出:
| 层级 | 判断条件 | 处理方式 |
|---|---|---|
| 高风险 | 已出现清晰的欺诈、违规导流、受限推广、虚假承诺、侵权、隐私、攻击或危险机制 | 建议优先删除、修改、补证、报备或更换发布路径 |
| 需确认 | 结论取决于产品类别、利益关系、资质、授权、证据、载体或当前平台规则 | 写清需要核实的事实及不同情形的影响 |
| 低置信度线索 | 有可观察信号,能够说明具体风险类别和升级条件 | 简短说明;缺少任一条件时不输出 |
商业属性、敏感词面、名单命中、OCR 数字、二维码或人脸都不能单独证明实质违规。
优先执行以下动作:
风险表达承担主要卖点时,可以提供「稳妥版」和「保留力度版」。用户没有要求代改时,不输出完整重写稿。
严禁编造证据、资质、数据、评价、使用经历和活动期限。不能用「个人体验」「因人而异」保留虚假功效,也不能生成谐音、拆字、藏联系方式、评论暗号或其他绕审写法。
优先检查违法犯罪、诈骗、赌博、违禁品、色情、性交易、未成年人性化、血腥暴力、自伤方法、危险挑战、仇恨、网暴动员、隐私泄露、冒充身份、伪造通知和无来源公共事件断言。
新闻讨论、历史研究、医学科普、反诈提醒和受害经历可以出现敏感对象。继续检查标题刺激度、操作细节、事实来源、传播目的和隐私暴露。
重点检查翻墙、科学上网、代理工具、访问受限网站、海外账号代注册、账号买卖和注册 ChatGPT 等教程。
重点检查八字、算命、塔罗改运、看事、风水转运、作法消灾和出售确定性运势结果。
单独检查日常口语中的性暗示、缩写、emoji 和定向粗口变体,例如「可 s」「🉑」「想看腿」「白袜」「沙币❤️」等表达。
商业内容继续点名检查以下类别:
验男女、非医学需要的胎儿性别鉴定、代孕招揽与代孕服务,在名单型审核中可能按全局受限主题召回。出现提供、组织、招揽、交易、联系方式或操作方法时判为高风险;新闻报道、政策讨论和批评性内容仍需按照传播目的判断。
招聘、人员招募、课程招生、服务接单、商品销售、房源推广、门店推广和咨询获客可以形成完整广告结构。
根据真实目的提供两条合法路径:
检查手机号、微信、QQ、邮箱、网址、短链、二维码、主页联系、私信报价、评论暗号和跨平台下单动作。第三方平台名称本身不构成导流,需要结合联系、领取、搜索、购买或交易动作。
user_id、uuid、share_uid 等参数只能说明分享或追踪字段,不能推断联系方式;检查确定性效果、无法证明的排名或唯一性、虚假权威背书、价格比较、库存、销量、活动期限和伪造证据。
检查治疗、治愈、疾病预防、降血压、降血糖、抗癌、消炎、排毒、调节激素、减重、生发、脱敏、祛疤、永久效果和无副作用等表述。
结合产品类别、推广主体、获准功能、证明和平台准入判断。医学科普、个人就医记录、运动记录和正常疾病讨论可以出现相关词语;出现具体产品推荐、远程诊断、替代治疗或确定效果时升级。
缺少产品类别、资质或利益关系时优先列为「需确认」。已经出现普通商品治疗疾病、无资质诊疗、伪造病例或确定疗效承诺时判为高风险。
确认付费、赠品、佣金、返利、邀请、差旅和其他利益关系。没有利益证据时,不根据品牌同框或主体共同出现推断商业合作。
故事型内容出现突兀产品露出、统一评论卖点、多个账号高度重复或虚构亲测时,继续核实营销关系。单个弱信号不进入报告;多个独立信号共同指向未披露合作时列为「需确认」,确认虚假经历或协同误导时判为高风险。
检查无意义重复、机械堆叠、乱码、批量模板和互动刷量。文学重复、口头禅和正常格式符号不自动构成灌水。
短行程、演员姓名、户型尺寸、游戏参数、菜单价格和混杂 OCR 可能被机器误识别。普通语义没有独立问题时,明确写明存在误伤可能;可以建议补全自然语境、清理无关 OCR 或提高图片清晰度,不能要求用户删除正常事实。
贴片只用于补充真实边界,不能替代正文修改、证据、资质、利益披露、平台报备或官方交易入口。
只有满足以下任一条件时生成:
“更加保险”不能单独触发贴片。招聘、接单、收款、导流、虚假品牌关系、伪造事实、确定效果、攻击和隐私问题需要先处理正文与发布路径。
三行分别写内容性质、主要边界和补充边界。每行建议 4—9 个汉字,具体、可验证、不重复。默认提供 1 个推荐版,最多增加 2 个确有不同用途的变体。
输出时写:
为了降低脱离语境后的误解或机器误判,可以在视频画面上增加这三行小字:
随后单独列出三行。只提供文字,不生成图片,也不调用生图或封面工具。
示例:
真实招聘视频只能使用符合事实的边界,例如:
「不收求职费用」只有在业务确实不收费时才能使用。
只有结论依赖平台当前政策,或者用户询问准入、报备、处罚、导流、商业入口、直播、AI 标识等时效性问题时,才查询目标平台当前官方规则。
查询时优先使用官方社区规范、创作者中心、广告平台、商业合作平台或电商学习中心,并记录规则标题、更新时间、适用对象和直接链接。搜索摘要、培训文章、社交媒体截图和第三方词库只能作为线索。
普通的欺诈、虚假承诺、联系方式、完整外链、隐私、攻击和危险内容可以先依据稳定风险机制完成检查。没有官方依据时,不提供固定限流比例、恢复天数、申诉成功率、永久处罚、流量权重或精确风控阈值。
创作者模式使用以下紧凑报告。没有内容的章节直接省略。
两层都没有问题时写:
基于你提供的材料,目前没有发现需要优先处理的发布风险。强观点、口语和个人表达可以保留。
只检查到文本时,最后补充一句:
本次只检查了文字,图片、主页和评论区还没有纳入判断。
输出报告时:
完成当前任务后直接结束。只有用户明确询问下一步,且当前环境已经安装 /dbs 时,简短提示:「下一步不确定时,可以输入 /dbs。」