当前位置:首页>php>PHP 现代化 AI 测试框架 Pest V5.0 发布!

PHP 现代化 AI 测试框架 Pest V5.0 发布!

  • 2026-10-11 05:41:11
PHP 现代化 AI 测试框架 Pest V5.0 发布!

Pest 5 正式发布

Pest 有史以来最重要的版本——Pest 5 正式发布。

本版本基于 PHP 8.4 与 PHPUnit 13 构建,整合了 Pest 4 迭代周期中逐步打磨的多项功能与官方插件,如今全部稳定、完善,正式面向生产环境可用。

  • Tia 引擎:仅重跑受代码变更影响的测试——原本需要 10 分钟的测试套件,现在回放仅需约 4 秒,且代码覆盖率的准确性完全不受影响。
  • Agent 插件:让 AI 编码智能体只需一条命令,即可验证代码改动是否真正生效——测试运行在你真实的测试套件中,若安装了浏览器测试插件,还能驱动真实浏览器完成验证。
  • Evals 评测能力:直接在测试套件中评估 LLM 智能体与 AI 生成内容的质量,通过你熟悉的 expect() API,将确定性校验与 AI 评分能力相结合。
  • 官方 PHPStan 插件:让 PHPStan 正确识别 Pest 的函数式 API——it()、expect()、$this 等,让你的测试代码和业务代码一样具备完整的类型保障。
  • Rector 自动重构:内置数十条重构规则,自动现代化你的测试代码,将原生 PHP 断言转换为 Pest 更具表达力的断言写法。
  • 时间均衡测试分片:按测试的实际执行时长(而非用例数量)在 CI 多机间分配测试任务,让所有分片几乎同时完成。

下面我们将逐一介绍各项功能的使用方法。如需完整细节,各章节均附有对应官方文档链接。

升级到 Pest 5

对于绝大多数测试套件,从 Pest 4 升级只需要修改 composer.json 中的一行依赖:

-    "pestphp/pest": "^4.0",+    "pestphp/pest": "^5.0",

所有 Pest 官方维护的插件也都需要同步升级到 ^5.0 版本。

注意:Pest 5 要求 PHP 版本 ≥ 8.4。完整变更清单请查看官方升级指南。

Tia 引擎

这是我们最期待与大家分享的功能。

Tia 引擎全称为「测试影响分析(Test Impact Analysis)引擎」,它通过仅重跑受最新代码变更影响的测试,大幅缩短测试套件的执行时间。

使用方式非常简单,在任意 Pest 命令后加上 --tia 参数即可:

./vendor/bin/pest --parallel --tia

首次运行时,会构建一份「测试-文件」依赖关系图谱——这一步需要代码覆盖率驱动支持(如 PCOV 或 Xdebug)。 

后续每次运行时,引擎会识别代码变更,仅执行涉及这些文件的测试,其余测试直接回放缓存结果。 一套典型的 Laravel 测试套件原本需要 10 分钟运行,现在回放仅需约 4 秒:

Tests:    774 passed (2658 assertions, 7 affected, 2 uncached, 765 replayed)Duration: 3.92s

测试回放并不是偷工减料的捷径——每一条缓存的测试都完整保存了所有执行结果,包括覆盖的精确代码行与分支,因此回放运行输出的代码覆盖率结果和全量运行完全一致。

同时,依赖树能够识别你的整套技术栈:

  • 修改迁移文件时,仅重跑涉及对应数据表查询的测试
  • 修改公共 JS 组件时,会遍历 Vite 模块图,找到所有引入该组件的 Inertia 页面
  • 如果只是修改注释、格式化代码,则不会触发任何测试重跑

Pest 会通过 Composer 自动识别 Laravel、Symfony、Livewire、Inertia 以及前端静态资源。

对于团队协作场景,可以在 CI 中每次合并到主干(main)时生成一次基准缓存,所有开发者都可以拉取这份结果,直接享受加速能力。

Agent 插件

AI 编码智能体很擅长写代码,但它们很难判断写出来的代码是否真的能正常工作。 

Agent 插件补上了这一环:让智能体只需一条命令,就能对你的应用执行一次性验证。

首先通过 Composer 安装插件:

composer require pestphp/pest-plugin-agent --dev

该插件为 Pest 新增了 --agent 选项,可以在完整的 Pest 测试环境中运行一段代码片段——你的模型工厂、RefreshDatabase 特性、Laravel 模拟(Fake)能力都可以正常使用,和真实的功能测试完全一致:

./vendor/bin/pest --agent='$user = \App\Models\User::factory()->create(); $this->actingAs($user)->get("/dashboard")->assertOk();'

如果同时安装了浏览器测试插件,智能体还可以驱动真实浏览器,验证操作带来的副作用——比如提交联系表单后,断言邮件已成功发送,全部在一次探测中完成:

./vendor/bin/pest --agent='visit("/")->assertSee("Welcome");'

这也是 Agent 插件优于 Vercel Agent Browser 这类纯浏览器工具的地方:这类工具只能验证 UI 展示是否正确,但无法确认队列任务是否入队、邮件是否发送、数据是否写入数据库。 

而 Agent 插件运行在你真实的测试套件中,只要测试通过,就意味着从前端到后端的整条链路都真实生效了。

Evals 评测能力

测试大语言模型相关的应用,和测试普通代码有本质区别:同一个提示词每次返回的结果都可能不同,单纯的相等断言几乎没有意义。 

Pest 的 Evals 插件让你可以用熟悉的 expect() API,来评估 AI 输出内容的质量。

首先通过 Composer 安装插件

composer require pestphp/pest-plugin-evals --dev

接下来就可以编写评测用例——将确定性校验与 AI 评分器(如大模型裁判、语义相似度)结合使用:

useApp\Agents\CapitalCityAgent;it('can correctly answer capital city questions', function(): void{    expect(CapitalCityAgent::class)        ->prompt('What is the capital of France?')        ->toContain('Paris')          // 确定性校验        ->toBeRelevant()              // LLM 裁判评分:内容相关性        ->toBeSimilar('Paris, France'); // 语义相似度评分});

由于每条评测用例都会真实调用大模型,因此常规测试运行时会自动跳过这些用例——保证你的测试套件依然高速运行,默认不会产生任何 API 调用。 加上 --evals 参数即可执行真实的评测:

./vendor/bin/pest            # 跳过评测用例,无 API 调用./vendor/bin/pest --evals    # 真实调用模型,启用所有评分器

可评测的维度远不止于此:

  • 用 toBeSafe() 验证智能体能否抵御提示词注入
  • 用 toBeFactual() 校验内容的事实准确性
  • 用 toFollowTrajectory() 验证智能体是否按正确顺序调用了对应工具
  • 用 repeat() 对同一提示词进行多次采样验证
  • 你甚至可以编写自定义评分器

官方 PHPStan 插件

这是社区呼声最高的功能之一:Pest 官方原生支持 PHPStan。 

默认情况下,PHPStan 无法理解 Pest 的函数式 API——比如 it()、test()、expect() 以及测试闭包中的 $this。而这款 PHPStan 插件会让 PHPStan 正确识别 Pest 的所有语法。

安装方式:先通过 Composer 安装插件与 PHPStan 本体:

composer require pestphp/pest-plugin-phpstan --devcomposer require phpstan/phpstan --dev

如果你使用了 phpstan/extension-installer,插件会自动注册。 否则需要手动在 phpstan.neon 配置文件中引入扩展:

includes:-vendor/pestphp/pest-plugin-phpstan/extension.neon

配置完成后,PHPStan 就能完整识别 expect() 调用链的类型——包括高阶断言,比如 expect($user)->name->toBe('Nuno');同时能识别测试代码中的真实错误,比如无意义的断言:

expect(10)->toStartWith('1'); // 整数类型不可能满足 toStartWith 规则

除了类型推导之外,该插件还提供了多项 Pest 专属的检查规则:静态测试闭包校验、beforeAll() 中 $this 的使用校验、重复的测试描述、无效的 throws() 与 covers() 引用等等。

Rector 自动重构能力

Pest 的 Rector 插件提供了基于 Rector 驱动的自动重构规则,能够帮你简化、现代化测试代码,也可以用于 Pest 大版本的自动升级。

首先安装插件与 Rector 本体:

composer require pestphp/pest-plugin-rector --devcomposer require rector/rector --dev

然后在 rector.php 中引入预设规则集:

usePest\Rector\Set\PestSetList;useRector\Config\RectorConfig;return RectorConfig::configure()    ->withPaths([__DIR__ . '/tests'])    ->withSets([        PestSetList::CODING_STYLE,    ]);

启用该规则集后,数十条规则会自动将原生 PHP 断言转换为 Pest 更具表达力的写法,并将冗余的断言合并为链式调用:

-expect(count($array))->toBe(5);-expect(array_key_exists('id', $array))->toBeTrue();+expect($array)->toHaveCount(5)+    ->toHaveKey('id');

你可以先执行 vendor/bin/rector process --dry-run 预览变更,确认无误后再应用。 目前提供了编码风格与版本升级两类规则集,共计 60 条重构规则。

时间均衡测试分片

Pest 4 首次引入了测试分片能力——将测试套件拆分为多个块,在多台 CI 机器上并行运行。

Pest 5 对该能力进行了升级,推出时间均衡分片:不再按测试用例数量平均分配(这会导致部分分片运行时间远长于其他分片),而是根据测试的实际执行时长进行分配,让所有分片几乎同时完成。

使用方式:先生成一次执行时长数据:

./vendor/bin/pest --update-shards

执行后会生成 tests/.pest/shards.json,将该文件提交到代码仓库即可。 当使用 --shard 参数且该文件存在时,Pest 会自动按执行时长进行均衡分配:

./vendor/bin/pest --shard=1/4

如果在更新时长数据前新增了测试文件,测试依然可以正常运行——新增文件会被平均分配,已有测试保持时间均衡分配,同时 Pest 会提示你更新分片时长数据。

新增断言方法

Pest 5 也为断言 API 新增了多项实用能力。 日常开发中,我们经常需要校验值是否为合法邮箱、有效 IP 地址、ULID 格式等,这些场景足够通用,手写校验逻辑既繁琐又重复。

现在 Pest 原生提供了 toBeEmail()、toBeUlid()、toBeIpAddress()、toBeMacAddress()、toBeHostname()、toBeDomain()、toBeBase64()、toBeHexadecimal() 等断言方法:

expect('nuno@pestphp.com')->toBeEmail();expect('01ARZ3NDEKTSV4RRFFQ69G5FAV')->toBeUlid();expect('192.168.1.1')->toBeIpAddress();expect('00:1a:2b:3c:4d:5e')->toBeMacAddress();expect('example.com')->toBeHostname();expect('example.co.uk')->toBeDomain();expect('Zm9vYmFy')->toBeBase64();expect('deadbeef')->toBeHexadecimal();

当然,所有断言都支持通过 not 进行取反。

基于 PHP 8.4 与 PHPUnit 13 构建

Pest 5 最低要求 PHP 8.4 版本,底层基于 PHPUnit 13 构建,你可以同时享受到语言与测试框架的最新特性与优化。

感谢有你,Pest 5 正式到来

现在正是入手测试、开始使用 Pest 的最佳时机。 如果你想立刻开始使用 Pest 5,可以查看安装指南;如果你正在使用旧版本,我们也准备了完整的升级指南供你参考。

感谢大家一直以来的支持与反馈,我们非常期待看到大家用 Pest 5 构建出更多精彩的项目!

最新文章

随机文章