Fine-tuning an LLM to write docs like it's 1995
passo.uno原文 ↗
作者用 Bitsavers 和 Internet Archive 的 Microsoft 旧手册微调小模型,让它写出 1990s 技术文档风格。训练语料来自 1977-2005 年 out-of-print docs,超过 3,700 万词;清洗后得到 192,456 个 JSONL examples,训练适配器总成本约 50 美元。实验结果显示 Qwen 2.5 7B 的 fine-tune 能把 REST API 这种年代错位概念写成接近旧式资源手册的结构,但作者也强调这类模型仍缺判断力,只适合辅助风格和草稿。
–浏览
评论 · Comments