能力入口 · 个人维护的能力入口

具名媒体中的本人判断

在确实需要判断“照片里是不是我、录音里有没有我的声音”时给出有位置和覆盖范围的可反驳证据,同时阻止大范围扫脸、扫声纹或识别其他人。

照片适配已有8项测试,语音复用ChineseASR句段证据;Skill仍缺独立语音回归。本次没有比较真实照片或录音,判断始终限定实际测试位置。

先看怎么用

你不需要记住 Skill 名,直接说需求就行

什么时候用

  • 判断本人是否出现在一张明确照片中
  • 指出照片中疑似本人的人脸位置
  • 判断一段选定录音或视频音轨中的精确片段是否支持本人说话
  • 只处理一个文件或很短的明确列表

可以直接这样说

例如我指定一张合照问“这里面有没有我”。它只检查这张图,返回疑似本人的脸部位置、质量和不确定性。

最后会得到什么

我会得到针对具名文件、可以回到原位置核对的结论;证据不足就返回未知,不识别其他人的身份。

不适合这样用

  • 扫描相册、目录或整个媒体库
  • 识别或命名其他人
  • 建立人脸或声纹库
  • 把相似度当法律身份
  • 凭一小段声音就把同一组所有话都算作本人说的

正常时

指定媒体、本人模板和质量足够时,返回脸部位置或声音时间段。

发现问题时

画面与声音证据冲突、质量低或覆盖不足时分别报告,仍不能判断的部分保持未知。

入口不可用或证据不足时

本人模板、识别模型或具名文件不可用时停止判断,不临时建库、不扩展扫描,也不识别他人。

从哪里开始

在当前 AI 对话点名一张照片或一段录音,问本人是否出现在画面或声音中;视频语音只检查其音轨,画面要另选少量静帧。

需要准备什么

  • 一份明确文件,或已从媒体检索选中的少量图片;音视频一次处理一份
  • 要判断画面还是声音,以及已有的真实时间或场景线索

为什么需要这个能力

仅凭一句“看起来像”无法复核,批量扫描整套媒体又会扩大范围。判断本人还必须区分画面证据和声音证据。

从需求到结果

1

明确选一张照片、一个录音或很短的文件列表,说明是否需要判断本人出现;不扫描相册、目录或整个声音库。

2

照片返回疑似本人的人脸位置与质量;录音返回有依据的精确时间段和覆盖,未检查句段不能借同一声音分组自动归给本人。

3

复用仍有效且绑定当前原件的证据;模板缺失、质量低、遮挡或声音太短时说明未知,不从未知目标现场建库自证。

4

照片与声音分别报告,冲突不强行合并。没检测到人脸不等于本人不存在,结果也不是法律身份认证,不识别其他人的姓名。

失败时会怎样恢复

照片里没检测到脸,或语音太短

系统反应:保持无法判断,不写成本人一定不在。

恢复方式:换更清楚的原件或精确片段,再对选中的少量文件核对。

本人参考样本缺失、已更换或与待判断文件同源

系统反应:停止这次本人归属判断,不能靠同一文件自我证明。

恢复方式:只用独立、仍有效的本人参考样本重新比较,不从这份待判断文件现场建档。

视觉和语音结论冲突

系统反应:分别报告,不合并成一个身份结论。

恢复方式:保留各自原件、框、时间段和覆盖缺口。

返回 Skills(能力)