scripts/build_embedding_outliers.py.
⚠ 证据等级。 分数出自自建联合模型之嵌入(phase-16 语义索引,希腊记录之 30,000 件抽样 —— 并非全库)。每条线索均未经审核。此处不断言任何语料有误;不在此列亦不证明无事。年代与地区照录索引元数据,绝不推断。方法与数据:数据集 · 以 scripts/build_embedding_outliers.py 再生成。
The queue队列
Score = 1 − mean cosine similarity to the 10 nearest same-cell neighbours (median across all scored texts: …). Click an id to read the text in its source database via the resolver.分数 = 1 − 与同格 10 个最近邻之平均余弦相似度(全体已评分文本之中位数:…)。点击编号可经解析器往源数据库读取全文。