AI 工具链

多语言仓库里给补全定目标语言:一条提示词怎么写才不串 API

在多语言仓库中锁定目标语言,最有效的方法不是声明语言,而是用文件路径、符号锚点、起始代码和显式排除项构建强上下文边界。路径与扩展名是模型判断语言的第一信号,版本号能进一步收窄语法假设;提供同文件已有符号或一行高信号起始代码,可让模型在目标语言内开始补全;排除项需具体到包名和关键符号,并放在符号锚点之后,避免模型进入防御模式。整体顺序为路径→符号锚点→起始代码→排除项→补全指令。

AI 工具链

训练数据里混入多级目录路径,模型才肯照你的 monorepo 约定生成引用

微调私有代码库模型时,需在训练数据中显式加入完整的 monorepo 多级文件路径,而非仅函数签名或扁平文件名。核心做法包括:每条样本附带真实相对路径与对应 import 语句;构造 20%–30% 的“引用任务”样本强制学习函数到路径的映射;加入负样本和路径变体以区分同名函数与禁止写法;将目录约定写入每条样本前缀。实测加入路径字段后 import 生成正确率从 31% 提升至 87%,约 5200 条样本即可让 7B 模型掌握私有目录规范。