用途与实际影响
这项功能怎样使用
为什么需要它
商品标题含营销词、赠品和未选口味,支付账单又可能重复同一订单,退款还可能只是凑单后的撤回。只看次数会把模板、非成功订单和付款旁证都误算成喜欢;反过来,次数少或很久没买也不能自动写成不喜欢。
举个实际例子
我可以问:“这笔购买后来全额退了,为什么推荐里还算我喜欢?”系统会保留曾下单、支付和退款的事实,核对是否为可靠同订单链;闭合才把有效结局改为 refunded_full,并让依赖它的推定失效。
最后我会得到什么
交回这笔交易真实发生到哪一步:曾下单、支付旁证、后来全退或部分不明,以及能核对的时间与商品差别。全退会退出普通推荐依据,却不代表本人讨厌。
已核对事实
具体订单和可靠来源对应时,分开列下单、支付、退款与本人表达;需要时再核原件。
证据不能升级
只有付款、模板、赠品或退款关系不清时不升级成喜欢;很久没买也不升级成讨厌。
原件核对不可用
原件不见或内容变了时不拿旧片段冒充新原文,先说明无法核对的部分。
从哪里开始
点名一笔购买、退款或具体行为,问事实到底怎样。
需要准备什么
- 品牌、品类或具体订单线索
从开始到拿到结果
- 1
系统核对并处理
回查同一交易链,分开下单、支付旁证、全退与部分不明;必要时才打开已验证原件。
- 2
交付与接续
交回有效结局和不能证明的内容;全退退出普通推荐依据,不反推讨厌。
技术实现与依据
这里保留实现、关键条件、精确入口、历史记录和验证结果。
全额退款传播继续有效;信用卡 1,287 消费、192 退款、32 账单是 2026-09-04 的专项观察。本轮新增未匹配有效支付的语义召回,订单旁证与独立消费事实分开关键规则与设计选择
order_observation 只证明买过/点过;可靠同订单链全额退款会把此前成功行的 effective outcome 改为 refunded_full,退出 repeat_count 与快照支持。
原订单、支付和退款继续出现在 facts,并给出 full_refund_count;退出普通 evidence 不等于生成负向偏好。部分退款、组单或关联不唯一保持 partial/Unknown(未验证)。
久远成功记录继续计入 facts 与可返回证据;低频、长期未买和没有记录都不是负向事实,只有本人当前拒绝/纠正或其他直接反证才支持负向偏好。
支付宝只归一已确认的 T200P 淘宝订单号变体;微信与信用卡 payment_observation 只补支付渠道和消费链,不重复购买,也不参与支付宝净额求和。
user_expression 只有本人现实表达候选才成立,AI 仍做最终语义判断。
淘宝营销前缀、饿了么商家模板、赠品和未选‘三选一’过滤。
facts 按品牌与品类词要求 all-term match,并分正向/负向状态、首末时间和变体。
公开真实 L2 样例保留具体苏打水语义,不公开商家、金额、账号、路径或原始聊天。
original 先核制品 SHA;ChatGPT 再核消息 content hash(内容指纹),PDF 从同字节制品重新抽取并做窄掩码,因此不是逐字原文;其他类型标 verified_artifact_cached_excerpt。
本模块用到的名词
- order observation(订单观察)
- 平台记录显示买过或点过;不自动表示喜欢、满意或本人使用。
- refunded_full(已全额退款)
- 此前成功订单/支付后来被可靠同订单链的已完成全额退款覆盖;原事实保留,但普通偏好、复购和快照支持退出。
- payment observation(支付旁证)
- 说明支付链或渠道发生过;已有详细订单时不能再当一笔购买。
- artifact verification(制品验真)
- 重新计算原文件 SHA-256,先证明 locator(原件定位记录) 仍指向导入时同一字节。
专业定义
项目敢于推测,但一笔成功购买后来全额退款时,必须沿可靠订单链纠正有效结局;原事实不抹掉,普通偏好也不继续吃旧证据。
解决什么
解决买过=喜欢、付款=第二次购买、非成功订单=复购、无记录=不喜欢、商品标题泛化、模板/赠品混入和原件漂移后继续输出旧片段。
当前怎样实现
- preference_fact_text 清理淘宝营销前缀,并从饿了么商品串中筛掉非偏好模板。
- facts 扫描 current(当前状态) 与订单链状态,按 evidence role/source 分组,统计有效结局、full_refund_count、时间和文本变体;原交易事实不会因退出偏好而删除。
- evidence 在排序前排除退款、关闭、取消、失败与 refunded_full 行;repeat_count 只累计仍为正向有效结局的订单。
- 退款传播只使用同源精确订单号与已确认的支付宝 T200P 变体;金额/时间不符、处理中/失败、跨支付渠道同号、部分退款、组单或候选不唯一都不传播。
- 信用卡同源只在同币种、规范化商户、精确金额、先消费后退款且双方候选唯一时形成全额退款旁证;不生成第二次购买。
- original 从 records 定位 artifact,先核存在和 SHA-256;ChatGPT 再定位 conversation/node 并核 content SHA。
- PDF 重读异常返回 original_unreadable;XLSX/CSV/TXT/Gemini 返回已验真制品的缓存片段。
执行流程
- 1
先用 evidence 找候选
- 2
确定品牌/品类词
- 3
facts 全量核对具体记录
- 4
分订单/付款/表达角色
- 5
统计状态/时间/变体
- 6
只有细节改变结论时调用 original
- 7
向 AI 返回事实和不能证明项
边界
- 正向交易状态不等于满意。
- 非成功或 refunded_full 交易事实不等于喜欢或不喜欢,也不进入普通偏好 evidence。
- 部分退款、组单、多商品、跨渠道同号、金额/时间不吻合或关联不唯一保持 Unknown(未验证)。
- 没有记录、次数少或长期未买都不等于不喜欢。
- 支付只作旁证,不重复购买。
- 不公开 locator(原件定位记录)、原始对话或财务组合。
- 不为一次事实核对扫描新目录。
失败与恢复
- 商家模板、赠品或未选项混入
- 从 preference_fact_text 过滤;没有可用商品时不造事实。
- 订单退款、关闭、取消或失败
- facts 保留 matched/negative 交易事实;普通 evidence、模型上下文和 repeat_count 排除,不能据此生成喜恶推定。
- 已成功订单后来出现可靠同订单链全额退款
- 标记 refunded_full、保留原始事实、退出普通 evidence/repeat_count/快照支持;依赖推定 stale。
- 部分退款、组单或订单链关联不唯一
- 保持 partial/Unknown(未验证),不整单清退,也不继续把它包装成已确认成功偏好。
- 记录久远、低频或没有命中
- 保留久远有效成功事实;低频或无记录只表示证据较弱/未知,没有直接反证时不生成负向偏好。
- 原件文件不存在
- 返回 original_missing、text=null,不输出缓存。
- 原件 SHA-256 变化
- 返回 artifact_changed、text=null;要求重新 ingest。
- ChatGPT 消息定位或 content hash(内容指纹) 变化
- 返回 record_content_changed,不冒充同一原话。
真实入口
daily_preferences.py实现事实清理、facts 分组、证据角色、精确链接和 original 验真。
tests/test_daily_preferences.py覆盖具体苏打水语义、模板/赠品、订单/退款/支付角色和原件 missing/changed/valid。
CURRENT.md提供当前推定中的公开普通事实摘要;原始正文不进入网页。
如何验证
- 真实回读 1,287 条信用卡消费、192 条退款和 32 份账单摘要;旧 30 条整页 credit_statement 已退出 current(当前状态),支付事实不重复购买。
- 全额退款夹具证明原订单/支付/退款仍可 facts 回读,同时普通 evidence、repeat_count 与依赖快照退出。
- 部分退款、组单、跨渠道同号、金额/时间不符与候选不唯一均保持 Unknown(未验证)。
- 六年前的单次成功记录仍可返回;一次成功耐用品、软件或行程不因无复购降为不喜欢。
- 修改/删除已导入原件时 original 返回 changed/missing 且 text=null。
- 有效 ChatGPT ZIP 重新打开并核消息 content hash(内容指纹)。
与其他模块的关系
它把证据查询的候选变成可核对事实;推荐模块只能在这个事实边界内解释,不得升级证明力。
