AI 神奇
首頁
探索最佳AI工具
您尋找適合任何任務的人工智能解決方案的終極目錄。
Search
人工智慧測試
(71)
S
open source
SnapDiff MCP
呼叫 SnapDiff 託管 API 進行截圖、視覺比較、變化檢查及 HTML/CSS 影像渲染。依變更意圖驗證介面需專案與基準,可能返回人工審核判定。需要 API 金鑰;視覺差異本身不能驗證應用行為。
人工智慧測試
A
open source
Awarse Healwright MCP
使用 Gemini 依 ARIA 快照建議 Playwright 定位器,檢查唯一性和可見性,並可修改測試檔案。需要模型憑證與瀏覽器相依套件;模擬模式僅供離線測試。快照會傳給模型,定位器唯一不代表仍驗證原定行為。
人工智慧測試
M
open source
MotionLint
以確定性瀏覽器測量檢查網頁動畫時長、緩動和減少動態效果支援,並可選視覺模型設計評審。需要 Chromium;模型評審須設定服務商或本機模型。規則分數及模型發現輔助審核,不證明完整無障礙合規或普遍設計品質。
人工智慧測試
C
open source
CIAgent
一個用於評估 AI 代理的工具,具有穩定性報告、翻轉歸因、LLM 評判審計和源自知識庫的確定性檢查等功能。
人工智慧測試
穩定性報告
翻轉歸因
LLM 評判審計
+1
C
open source
ClawBench
ClawBench 是一個用於評估瀏覽器 AI 代理在日常任務上的基準。
人工智慧測試
評估瀏覽器 AI 代理
日常任務
M
open source
Multi-SWE-bench
多語言基準,用於評估軟體代理在問題解決上的表現。
人工智慧測試
A
open source
AgentLeak
AgentLeak 提供 Python SDK、CLI 和 MCP 工具,用於檢查智慧體在工具呼叫、記憶、訊息和日誌中的資料外洩,並提供去識別化報告和 CI 檢查關卡。
人工智慧測試
資料外洩測試 Python SDK
資料外洩測試 CLI
資料外洩測試 MCP 工具
+2
D
open source
DOS (dos-kernel)
用於檢查 AI 代理的完成聲稱對 Git 證據的工具。
人工智慧測試
A
open source
Agent-Wiz
Agent-Wiz 是一個用於威脅建模和視覺化 AI 代理的命令行界面 (CLI),其建構框架包括 LangGraph、AutoGen 和 CrewAI。
人工智慧測試
威脅建模
視覺化 AI 代理
A
open source
AgentSkeptic
AgentSkeptic 是一個用於檢測 AI 代理工作流程中靜默失敗的工具,通過驗證實際系統狀態。
人工智慧測試
檢測靜默失敗
驗證系統狀態
B
open source
BrowserTrace
用於瀏覽器使用失敗的本地重放調試器,帶有截圖、模型輸入/輸出、失敗步驟時間線和 HTML 導出。
人工智慧測試
截圖
模型輸入/輸出
失敗步驟時間線
+1
L
open source
Lians
一個用於檢查 AI 編程代理工作並將檢查結果綁定到當前 Git 狀態以供人類審查的工具。
人工智慧測試
檢查 AI 編程代理工作
將檢查結果綁定到 Git 狀態
促進人類審查
A
unknown
agent-qa
開源自我改進的 QA 代理程式,供軟體團隊使用。一個具有記憶功能的測試套件。用自然語言為網站和移動裝置編寫測試。agent-qa 從每次執行中學習,適應 UI 變更,並在您發布之前抓取回退。
人工智慧測試
自我改進的 QA 代理程式
具有記憶功能的測試套件
用自然語言編寫測試
+3
R
open source
RAMPART
RAMPART是一個專為代理式AI應用程式設計的pytest原生安全性和安全性測試框架。
人工智慧測試
pytest原生安全性和安全性測試框架
專為代理式AI應用程式設計
MIT授權
H
open source
hidai25/eval-view
一個用於 AI 代理的回歸測試框架,可保存金絲雀基線並檢測行為漂移。
人工智慧測試
保存金絲雀基線
檢測行為漂移
在 CI 中阻止回歸
+1
K
open source
KryptosAI/mcp-observatory
用於MCP伺服器的回歸測試工具,可自動發現伺服器、檢查功能,並偵測模式變動。
人工智慧測試
自動從Claude設定檔發現MCP伺服器
檢查伺服器功能
啟動工具
+3
T
open source
tsilverberg/webapp-uat
一個全瀏覽器的 UAT 技能,用於 Playwright 測試,具備多種功能。
人工智慧測試
使用控制台/網絡錯誤捕捉的 Playwright 測試
WCAG 2.2 AA 無障礙檢查
i18n 驗證
+2
C
open source
claude-bug-bounty
Claude Code 技能,用於 AI 辅助漏洞獵捕,可自動化進行安全測試。
人工智慧測試
自動化進行偵察、IDOR、XSS、SSRF、OAuth、GraphQL 和 LLM 注入測試
4門驗證清單
報告生成
S
open source
Souzix76/n8n-workflow-tester-safe
一個透過MCP測試、評分和檢查n8n工作流程的工具。
人工智慧測試
配置驅動測試套件
兩層評分
輕量級執行追蹤
+1
R
unknown
Rhesis
測試 LLM 和代理應用程式的基礎設施,並具備協作評估功能。
人工智慧測試
測試 LLM 和代理應用程式的基礎設施
協作評估功能
T
unknown
test-driven-development
使用測試驅動開發方法實現功能及錯誤修復。
人工智慧測試
將測試驅動開發整合到任何專案中
在撰寫實現程式碼之前應用
提升軟體品質與可維護性
A
unknown
Ai-Api-Testing
用於 API 和代理式工作流程的 AI 測試生成器
人工智慧測試
用於 API 的 AI 測試生成
支援代理式工作流程
可在 GitHub 上使用
W
unknown
webapp-testing
基於 Playwright 的工具,用於本地網頁應用程式測試和除錯
人工智慧測試
使用 Playwright 進行 UI 驗證
本地網頁應用程式測試
除錯功能
Previous
Page 3 of 3
Next