在 LLMTest_NeedleInAHaystack 测试方法中加入了本地模型的测试,目前支持qwen系列(7b,14b,32b)。 评估模型可以使用本地模型或者在线api
主要测试模型知识掌握能力,支持考题导入,可进行多项测试打分,如:代码生成、头脑风暴、数学等
主要测试模型长文本推理能力
- 本地评估模型:Qwen系列(7b,14b,32b),Together.ai的在线api,OpenAI 在线api
- 本地测试模型:Qwen系列(7b,14b,32b)
- CPU推理测试
- 性能测试
This project includes code derived from LLMTest_NeedleInAHaystack, which is licensed under the MIT License.
Original project authored by gkamradt.
The original project's license file (LICENSE) can be found in this repository.