agent-browser を使って e2e をエージェントにやらせるようにしてみました
以前に Playwright の代替として利用可能な agent-browser という CLI ツールがあるという話をしていたのですが、今回は導入して試したという話です。
導入するにあたって、現時点では少しコントロールの難しい部分もある事があったのでまとめます。
以前の紹介記事
agent-browser を e2e に利用する難しさ
単純に、まだモデルが学習をしっかりできていないという問題があります。
そのため、e2e テストを agent-browser を使って実装してとお願いしても勘違いして Playwright を使おうとしたりします。
コントロールするために
上手くコントロールするために、先に agent-browser についての知識をまとめたスキルを用意し、そのスキルを使ってテスト方針を作成させます。
言語にはライブラリは現時点ではないので e2e に使う用にシェルスクリプトを実装させる事になりました。
AI に直接触らせる前提のものではありますが、シェルスクリプトでテストできるのは言語依存を無くせるので便利だと思ってこういう構築にしてみた訳ですね。
使ってみて
セッションのコントロールなどを細かく CLI で用意してくれているため、実は非常に良いのではないかという気持ちになっています。
ただ、今は agent-browser を使って e2e をテスト、良い感じのレポートを作る仕組みが無いと思うのでそれを自作しないといけないという問題はあります。
ここは課題だと思ったので、自作してみるというのは手だなと思いました。
まとめ
AI エージェントによる e2e ではなく、スクリプトで運用するテストにしてみました。
使ってみた感想は思ってた以上に細かく利用できるため、流石 AI エージェント向けの Playwright MCP の代替として作られているなというクォリティです。
もはやエージェント利用以外での運用としても問題がないくらいに活用できると感じます。
私はゴールデンテストでの利用とプログラムでの e2e テストと両面で運用していますが、今の所課題を感じていません。
難しかったのは AI が理解できない瞬間がある事ですが、CLAUDE.md などメモリに記載する事で指向性は与えられるため準備さえちゃんと仕込めば正しく利用できるようになります。
この記事を書いている今もひたすら e2e テストをさせて品質を上げるためのテストを延々と実行させていますが経過は良好です。
非常に良い感想を持ったので、これからももっと掘りさげて記事を色々書いていきます。
この記事の内容がいいなと思ったら、スキ・フォローで応援していただけると嬉しいです。
弊社ではお仕事の依頼を募集しています。
記事中では具体的な数字がでていますが、内容によって調整可能となりますので、お気軽にお問い合わせください。
