Prelint は、製品仕様と判断ルールに照らして pull request をレビューし、変更前に乖離・矛盾・不一致を検出します。リポジトリ内で製品文脈を管理し、各レビューの監査証跡を残したいチーム向けです。
Argmin AIは、ワークフロー、ルール、ドキュメント、少数の例だけで、MLチームや独自の評価コードなしにAI機能をリリース前に評価できます。
Routebaseは、設計、モック、テスト、ドキュメント、ガバナンス、監視を1つの生きたspecでつなぐAPIライフサイクル管理プラットフォームです。AIエージェント向けのMCPサーバーも搭載。
TraceBug は、ブラウザの不具合を自動で収集し、オフラインで共有できる自己完結型 .html レポートにまとめるローカルファーストのバグ報告ツールです。MCPベースのデバッグや各種エクスポートにも対応。
Manta AIは、URLからWebアプリを巡回し、フローを可視化して不具合を自動検出する自律型Webアプリテストツールです。
DevAllyは、製品チーム向けのAI搭載アクセシビリティ準拠プラットフォームです。製品のスキャン、課題の優先順位付け、コンプライアンス文書の生成を支援し、アクセシビリティ対応を開発フローに組み込めます。
BugShotは、ブラウザ上で要素の検査・編集・キャプチャ・報告ができるChrome対応のバグ報告ツールです。Jira、GitHub、Linear、Notionへ送信できます。
Penligentは、セキュリティチーム、ペネトレーションテスター、レッドチーム向けのAI支援ペンテストプラットフォーム。Webアプリ、API、業務ロジック、AIエージェントの発見・検証・再現・証跡報告を自動化します。
BrainGridは、仕様書を先に作成し、承認後に構築・検証・本番実行まで行うAIアプリビルダー。個人、チーム、開発者向け。
cubicは複雑なコードベース向けのAIコードレビュー基盤です。PRでのバグ検出と、マージやリリース前のリポジトリ監査を支援します。
Cekuraは、AI音声エージェント向けの音声評価・オブザーバビリティプラットフォームです。リリース前の通話シミュレーション、ライブ会話の監視、品質シグナルの確認を支援します。
Browser Useは、実サイトで動作するAIエージェント向けのブラウザ自動化プラットフォームです。ステルスブラウザ、ホスト型Webエージェント、カスタムモデル、専用BoxでWeb自動化、抽出、QA、監視を支援します。
Haystackは、プルリクエスト運用向けのAIコードレビューツールです。変更の優先付けやリスクのある変更の可視化、決定事項と担当者に基づくレビュー振り分けを支援します。
Early は、コードベース全体や連携システム、重要な業務フローを対象に変更をレビューする regression guard プラットフォームです。テストの生成・検証、カバレッジ不足の可視化、本番前の regression リスク管理を支援します。
Latitudeは、AIエージェントの運用状況を可視化・監視するオープンソース基盤です。OpenTelemetry対応のトレース、アラート、セッション検索、evalワークフローで本番の問題把握と修正確認を支援します。
Cleanlabは、AIエージェントの誤回答をユーザー到達前に検出・修正し、ガードレール、human review、root-cause追跡を本番運用で支援します。
Braintrustは、AIの本番挙動をトレースし、評価を実行し、ユーザーに届く前に回帰を検出できるAI observabilityプラットフォームです。traces、datasets、scoring、workflowツールを備えています。
TestMu AI(旧LambdaTest)は、品質保証チーム向けのエージェント型AIテストクラウドです。AI支援のテスト計画、ブラウザ/モバイルテスト基盤、実行オーケストレーション、分析を一元化します。
Senseは高等教育向けのAI評価・フィードバックプラットフォーム。自由記述課題の評価、的確なフィードバック、LMSやIDEへの組み込みに対応。
Quashは、モバイルアプリのテストとQA自動化を、自然言語でフローを記述して実機のAndroid/iOSで実行できるプラットフォーム。実行、管理、バックエンド検証、レポートを一元化。