惯性聚合 高效追踪和阅读你感兴趣的博客、新闻、科技资讯
阅读原文 在惯性聚合中打开

推荐订阅源

S
SegmentFault 最新的问题
爱范儿
爱范儿
博客园 - Franky
OSCHINA 社区最新新闻
OSCHINA 社区最新新闻
WordPress大学
WordPress大学
宝玉的分享
宝玉的分享
雷峰网
雷峰网
酷 壳 – CoolShell
酷 壳 – CoolShell
IT之家
IT之家
有赞技术团队
有赞技术团队
美团技术团队
Last Week in AI
Last Week in AI
奇客Solidot–传递最新科技情报
奇客Solidot–传递最新科技情报
大猫的无限游戏
大猫的无限游戏
The Cloudflare Blog
Jina AI
Jina AI
钛媒体:引领未来商业与生活新知
钛媒体:引领未来商业与生活新知
Engineering at Meta
Engineering at Meta
T
Tailwind CSS Blog
J
Java Code Geeks
Martin Fowler
Martin Fowler
I
InfoQ
小众软件
小众软件
MongoDB | Blog
MongoDB | Blog

博客园 - badwood

iptables规则笔记 secueCRT脚本再试牛刀 主机基线脚本 大模型部署手册-英伟达 大模型部署手册-昇腾服务器 ssl自签证书+nginx 备忘 Claude Code私有化使用 mindie推理框架及工程化 minio-2.使用 minio-1.搭建 旧源消失的rpm包安装-devtoolset-9 vllm-ascend 2/2 -双机推理 MCP-1.hello world vllm-ascend 1/2 -单机推理 ESP32-S3玩具1-使用Arduino evalscope使用2-使用自定义数据集压测 设置fdfs自动启动 FunASR mindie开启DeepSeek的128K xinference推理embedding等小模型 离线安装docker 昇腾910b服务器初始化 大模型围栏-nginx+lua 大模型私有化部署-deepseek671-mindie dify-2:问题分类器调整
evalscope使用1-基础压测
badwood · 2025-09-05 · via 博客园 - badwood

一、安装

  • 基础安装命令:
#一般安装
pip install evalscope -i https://pypi.tuna.tsinghua.edu.cn/simple/
# 安装过程中碰到因为操作系统某些组件(gcc)版本过低,导致无法安装numpy等问题,使用--prefer-binary参数
pip install evalscope --prefer-binary -i https://pypi.tuna.tsinghua.edu.cn/simple/
# 安装所有组件用all,要进行性能测试,可单独装perf
pip install evalscope[all] --prefer-binary -i https://pypi.tuna.tsinghua.edu.cn/simple/
  • 数据集下载:
# 从魔塔上找到需要的数据集,复制下载命令,指定保存路径(会自动创建mmlu_pro)
modelscope download --dataset modelscope/MMLU-Pro --local_dir ./data/mmlu_pro
  • 生成模版文件:template.json
# 下面的模板文件是用ds生成,指定推理框架为vllm,模型为千问3,接口类型为openai
{
  "model": "{model}",
  "messages": [
    {
      "role": "user",
      "content": "{prompt}"
    }
  ],
  "stream": true,
  "max_tokens": "{max_tokens}",
  "temperature": "{temperature}"
}

二、性能测试

  • 初级测试命令,执行过程中可能会需要下载数据集
# 基于千问3-14B模型
evalscope perf \
--url 'http://ip:port/v1/chat/completions' \ --parallel 2 \ --model 'qwen3-14b' \ --log-every-n-query 10 \ --read-timeout 120 \ --connect-timeout 120 \ --number 20 \ --max-prompt-length 128000 \ --min-prompt-length 128 \ --api openai \ --query-template @template.json \ #template.json需要在当前目录 --dataset openqa

三、结果使用

  如无特别指定,数据会生成到当前目录的output子目录,可以让ds帮忙解读,可以得到一些不错的评价和建议(老手估计用不着)。

# benchmark_summary.json
{
"Time taken for tests (s)": 487.9671, "Number of concurrency": 2, "Total requests": 20, "Succeed requests": 20, "Failed requests": 0, "Output token throughput (tok/s)": 68.314, "Total token throughput (tok/s)": 77.0277, "Request throughput (req/s)": 0.041, "Average latency (s)": 48.2374, "Average time to first token (s)": 0.0747, "Average time per output token (s)": 0.0289, "Average inter-token latency (s)": 0.0289, "Average input tokens per request": 212.6, "Average output tokens per request": 1666.75 }