精选· 重要性 3/5
不要分类,直接让模型“幻觉”出标签
Simon Willison's Weblog··约 1 分钟阅读
中文导读
针对博客旧内容打标签的难题,Doug Turnbull提出先让LLM自由生成标签,再通过向量嵌入匹配现有标签体系,提高打标效率与准确性。
2026年8月14日-链接博客不要分类。幻觉!我的博客上还有很多旧内容,我从来没有抽出时间标记。我的博客有1,856个标签--可能太多了,无法一次性提供给LLM并说出“这些标签中的哪些与以下内容相匹配”。
道格·特恩布尔有一个巧妙的解决方案。告诉模型输出不包含现有词汇表任何详细信息的标签,然后针对现有数据库使用载体嵌入来找到与模型想象可能适合的标签最接近的具体标签!
他的示例提示建议包括标签形状的示例,以帮助模型做出更有用的猜测:您的任务是创建最适合搜索查询的新颖、从未见过的家具、家居用品或硬件分类。
产品分类可能看起来像:家具/客厅家具/咖啡桌和茶几/咖啡桌装饰和枕头/装饰枕头和毯子/枕头家具/卧室家具/梳妆台和衣柜厨房和桌面/厨房组织/食物储存和罐学校家具和用品/学校家具/学校椅子和座位/可堆叠椅子婴儿和儿童/幼儿和儿童卧室家具/儿童床下面是生成分类的查询:咖啡桌