Initial commit of LLM speed test app
This commit is contained in:
@@ -0,0 +1,33 @@
|
||||
"""用例6:复杂推理任务 —— 对比不同难度推理任务的延迟差异"""
|
||||
from ..ollama_client import OllamaClient
|
||||
from .base import case_meta, make_result
|
||||
|
||||
REASONING_LEVELS = [
|
||||
("简单问答", "什么是人工智能?", 80),
|
||||
("中等推理", "解释Transformer架构中的自注意力机制是如何工作的。", 200),
|
||||
("复杂推理", "分析大语言模型在长链推理中的主要局限性,并提出三种改进方案。", 400),
|
||||
]
|
||||
|
||||
|
||||
def run_test(client: OllamaClient, repeats: int = 2, stop_event=None) -> dict:
|
||||
"""执行复杂推理任务测试"""
|
||||
results = []
|
||||
for level_name, prompt, num_predict in REASONING_LEVELS:
|
||||
for i in range(repeats):
|
||||
if stop_event and stop_event.is_set():
|
||||
break
|
||||
infer = client.generate(
|
||||
prompt,
|
||||
options={"temperature": 0.3, "num_predict": num_predict},
|
||||
)
|
||||
results.append(make_result(
|
||||
infer, i + 1,
|
||||
reasoning_level=level_name,
|
||||
))
|
||||
|
||||
meta = case_meta(
|
||||
"case_06_reasoning", "复杂推理任务",
|
||||
"不同推理复杂度下的延迟对比", "耗时", 15,
|
||||
)
|
||||
meta["results"] = results
|
||||
return meta
|
||||
Reference in New Issue
Block a user