内容提要
作者利用LLM制作工具,为图标库补充颜色元数据。该工具通过HSV色相直方图分析未标记图标,生成HTML页面,左侧列出颜色,右侧分为“已标记”和“可能缺失”两栏。作者手动选择后复制ID,让LLM更新元数据。此方法高效,LLM擅长生成一次性代码,工具简单(HTML/CSS/JS),作者掌控视觉决策,避免盲目信任。
延伸解读
人机协作的视觉决策
作者没有让LLM直接标记颜色,而是要求它生成一个工具,将计算机的快速分析和人的视觉判断结合起来。工具通过HSV色相直方图对未标记图标进行评分,并列出“可能缺失”的候选,但最终由作者手动确认。这种设计避免了盲目信任模型输出,确保颜色分类符合个人主观标准,体现了“人在回路”的实用思路。
一次性代码的实用价值
作者强调LLM擅长生成“一次性”代码,这类代码不需要生产级质量,只需足够完成特定任务即可。工具以独立HTML文件形式存在,直接通过file://打开,无需构建工具或服务器。这种轻量级方法降低了使用门槛,让非程序员也能快速定制解决方案,而最终目标是元数据,而非工具本身。
阈值滑块的灵活调优
工具中的阈值滑块允许用户调整匹配的灵敏度,这体现了交互设计在数据清洗中的重要性。通过滑动阈值,作者可以发现更多可能遗漏的图标,也能排除明显误判的案例。这种手动调优机制弥补了算法可能存在的偏差,使分类结果更符合实际需求,也增强了用户对工具的掌控感。
Q&A
作者是如何利用LLM为图标库补充颜色元数据的?
作者让LLM生成一个HTML工具,该工具通过HSV色相直方图分析未标记的图标,生成一个页面,左侧列出颜色,右侧分为“已标记”和“可能缺失”两栏。作者手动选择缺失的图标后,复制其ID并让LLM更新元数据。
这个工具是如何判断一个图标可能属于某种颜色的?
工具对每个PNG图标进行处理,跳过透明像素和低饱和度的灰色,将剩余像素转换为HSV,然后计算落在该颜色色相带(例如橙色约为15-45°)的像素占比,以此作为匹配依据。
作者为什么选择让LLM制作工具而不是直接让LLM标记所有图标?
作者不想盲目信任LLM的输出,而是希望自己掌控视觉决策。通过工具,计算机可以快速处理并给出建议,但最终由作者人工确认哪些图标确实属于某种颜色,从而保证准确性。
这个工具的用户界面是如何设计的?
页面左侧列出颜色列表,点击颜色后右侧显示两栏:一栏是已标记为该颜色的图标,另一栏是可能缺失的图标。用户可以在“可能缺失”栏中选择图标,然后点击“复制”按钮复制所选图标的ID。
作者在工具中加入了什么交互元素来调整匹配的精确度?
工具中有一个阈值滑块,允许用户调整匹配的灵敏度。滑动滑块可以显示更多或更少的候选图标,帮助用户找到可能遗漏的图标或排除不相关的匹配。
作者从这个项目中得到了哪些经验教训?
作者认为LLM擅长生成一次性代码,不需要生产级质量,只要足够完成任务即可。此外,LLM适合制作单页HTML工具,无需复杂构建工具,使用基本的HTML/CSS/JS和CDN图片即可。最终目标是元数据,而不是工具本身。