18266417701
当前位置:LoadRunner首页 > 知识社区 > CNAS/CMA软件检测实验室建设 > LoadRunner LLM协议:为大模型应用而生
LoadRunner LLM协议:为大模型应用而生
时间 : 07-20 11:20 浏览量 : 38

传统HTTP压测将一次请求当整体计时,可大模型响应是流式的--用户感知的快慢不是总耗时,而是“第一个字多久出现”和“字与字之间卡不卡”。并发上去后KV缓存会爆、预填充会饱和,这些瓶颈在传统指标里完全看不见。OpenText在2025年7月的loadrunner25.3里上线了全新协议--LLM Protocol,从零开始为大模型应用量身定制。配合26.1已GA的Aviator,loadrunner正在“AI应用性能测试”抢回话语权。

LoadRunner LLM协议:为大模型应用而生

LoadRunner25.3引入的LLM Protocol,是业界第一个由主流商业厂商推出的、专门面向大模型应用的压测协议。它做了三件传统协议做不到的事

  1. 原生支持主流大模型后端

    开箱即用支持OpenAI、Gemini、Ollama,覆盖云端API和本地模型。流式连接、token事件追踪、并发管理都在协议层封装好,不用手写SSE解析

  2. 全新GUI配置

    提供专门图形界面,测哪个模型、提示词集、、并发怎么爬、流式与否都能点选完成,不擅长写代码的成员也能搭建压测场景。

  3. 专属Token速率监控器

    压测期间专用监控器实时展示两条曲线:Token输入处理速率(反映预填充吞吐)和Token解码速率(反映生成吞吐)。分开看才能定位瓶颈:输入速率掉但解码正常,是长下文把填充打满了;反过来则可能是解码阶段受GPU显存或批次调度限制。传统压测将两者混在一个“响应时间”里,看不出这种结构性差异

loadrunner从“测传统应用”到“AI帮你测传统应用”(26.1 Aviator),再到“专门测AI应用”(25.3LLM协议)。loadrunner正在“AI应用性能测试”抢回话语权。道普云(山东)智能科技有限公司为OpenText官方授权代理商,想获取更多信息欢迎随时与我们取得联系。

loadrunner代理商

标签:
您可能还在找这些
cache
Processed in 0.012544 Second.