"""用例6:复杂推理任务 —— 对比不同难度推理任务的延迟差异""" from ..ollama_client import OllamaClient from .base import case_meta, make_result REASONING_LEVELS = [ ("简单问答", "什么是人工智能?", 80), ("中等推理", "解释Transformer架构中的自注意力机制是如何工作的。", 200), ("复杂推理", "分析大语言模型在长链推理中的主要局限性,并提出三种改进方案。", 400), ] def run_test(client: OllamaClient, repeats: int = 2, stop_event=None) -> dict: """执行复杂推理任务测试""" results = [] for level_name, prompt, num_predict in REASONING_LEVELS: for i in range(repeats): if stop_event and stop_event.is_set(): break infer = client.generate( prompt, options={"temperature": 0.3, "num_predict": num_predict}, ) results.append(make_result( infer, i + 1, reasoning_level=level_name, )) meta = case_meta( "case_06_reasoning", "复杂推理任务", "不同推理复杂度下的延迟对比", "耗时", 15, ) meta["results"] = results return meta