知识库
按标签查找常见问题、实用解答和知识指南,了解概念、解决问题,发现适合自己的网站。
知识解答
- LLM evaluation 到底在评什么?从指标、数据集到上线前回归的完整思路
- LLM evaluation(大语言模型评测)的核心,是把“这个输出好不好”从主观感觉变成可重复、可比较的评分。它评的不是模型本身有多聪明,而是你的应用在真实任务上是否稳定达标。适用条件很明确:只要你在上线或迭代一个基于 LLM 的功能——客服机器人、文...
按标签查找常见问题、实用解答和知识指南,了解概念、解决问题,发现适合自己的网站。