Don't Classify. Hallucinate!
simonwillison.net原文 ↗
方案先让语言模型自由生成一个语义标签,再用向量相似度把它映射到受控标签库,而不是把成千上万个类别一次性塞进提示词。这样既保留生成模型概括新表述的能力,又让最终输出落回已知枚举,尤其适合类别集合过大、不断增长的场景。误差被清楚地分成两段:模型可能概括错,检索也可能把合理概括配到邻近但错误的正式标签。
–浏览
simonwillison.net原文 ↗
评论 · Comments