Bỏ qua, tới nội dung chính

Kiểm thử · AI

Tester Kit: agent chạy kiểm thử, người quyết định

Từ 3–4 task thủ công mỗi ngày đến 10–15 phiên agent chạy song song

Vai tròNgười thiết kế quy trình, xây skill và đào tạo

Tài liệu trong case: Tester Kit, Tình huống
test case tự động với agent
1.000+
thời gian của đội Tester
−70%
bug lặp lại trên cùng module
30% → 5%
phiên agent chạy song song
10–15

Tên khách hàng được ẩn; ví dụ và dữ liệu đã mô phỏng. Quy trình, phương pháp và số liệu kết quả là thật.

Vấn đề

Đội Tester kiểm thử 100% thủ công. Đa số thành viên không mạnh về công nghệ nên không viết được automation theo cách truyền thống. Mỗi người một ngày chỉ xong tối đa 3 đến 4 task, không đủ thời gian chạy lại case cũ, trong khi đội Dev đã dùng AI và đẩy tính năng ra nhanh hơn tốc độ kiểm thử.

Trước Tester KitBug cũ quay lại vì không ai kịp chạy lại case cũ
  • Bug lặp lại
  • Bug mới
  • Bug của một modulekhoảng 30% là bug lặp lại

Bối cảnh và vai trò

  • Team Tester bốn người, phục vụ nhiều dự án song song.
  • Test case lưu trên bảng tính, nhiều case lặp lại giữa các lần phát hành.
  • Tôi thiết kế quy trình, xây skill, đào tạo và theo dõi việc áp dụng, song song với vai trò BA.
  • Ràng buộc: tester không viết code; agent không được tự quyết định đạt hay lỗi; mọi kết quả phải có evidence.

Bước 1: Phân loại test case

Không phải case nào cũng nên giao cho agent.

Phân loạiCase nào giao agent, case nào test tay
Ví dụGiao agentNgười làm gì
Kiểm tra API và dữ liệuEndpoint trả đúng mã, database đúng trạng tháiCóXác minh báo cáo
Luồng giao diện lặp lại, ổn địnhĐăng nhập, tạo bản ghi, lọc danh sáchCóXác minh evidence
Luồng nghiệp vụ nhiều bước, có tính toánThanh toán một phần rồi kiểm tra công nợCóXác minh từng bước và số liệu
Cảm quan giao diện, trải nghiệmBố cục, màu sắc, thông điệpKhôngTest tay
Tích hợp bên thứ ba, thanh toán thậtWebhook, cổng thanh toánKhôngTest tay có kiểm soát
Khám pháTìm lỗi ngoài kịch bảnKhôngTester có chuyên môn

Bước 2: Thiết kế Tester Kit

Bộ kit gồm 8 skill, đóng gói để tester chỉ cần cài vào IDE là chạy được case tự động, không cần viết code. Các skill tiêu biểu nối thành một chuỗi:

Tester KitMỗi skill một việc, mỗi việc một đầu ra
  1. Sinh test casetừ story, acceptance criteria, business rules
  2. Kiểm tra trước khi chạymôi trường, dữ liệu mẫu, tài khoản test
  3. Chạy bộ casetrên staging, chụp ảnh, lưu log
  4. Regressionchạy lại case cũ của module vừa đổi
  5. Nháp bugbước tái hiện, kỳ vọng, thực tế
  6. Gom evidencethư mục đính kèm ticket
Quy tắcÁp cho mọi skill
  • Agent chỉ đưa kết quả sơ bộ: có vẻ đạt, có vẻ lỗi, hoặc không chắc.
  • Mỗi kết quả phải kèm evidence: ảnh, log, giá trị thực tế.
  • Không chạm dữ liệu production. Chỉ dùng tài khoản test.
  • Quyết định đạt hay lỗi cuối cùng thuộc về tester.

Bước 3: Chạy song song

Mỗi tester mở 10 đến 15 tab IDE agent (Claude Code, Codex, Antigravity), mỗi phiên chạy một nhóm case. Agent chạy trước, tester theo dõi bảng tổng hợp.

Một ngày của tester
  • Tester
  • Agent
  1. TesterChia nhóm case
  2. AgentChạy song songmỗi phiên một nhóm case10–15
  3. AgentKết quả sơ bộkèm evidence
  4. TesterXác minh evidence
  5. TesterTest taycase lỗi, case không tự động được
  6. TesterQuyết định QA
Chỉ các case lỗi và các case không tự động hoá được mới phải test tay.

Bước 4: Tình huống “trông có vẻ đạt”

Ví dụ mô phỏng cho thấy vì sao con người vẫn phải xác minh. Case: ghi nhận 1.000.000đ cho hoá đơn 3.000.000đ, công nợ phải giảm đúng 1.000.000đ.

Agent thấy

  • Màn hình hiện “Thanh toán một phần”.
  • Số dư giảm.
  • Kết luận: có vẻ đạt.

Tester thấy

  • Số dư trên màn hình có giảm.
  • Nhưng bản ghi hoá đơn trong database chưa đổi trạng thái: chỉ giao diện cập nhật tạm.
  • Quyết định: lỗi. Skill nháp bug tạo báo cáo kèm ảnh trước, sau và kết quả truy vấn.

Bước 5: Vai trò mới của tester

Tester từ người làm thủ công mọi thứ trở thành người xác minh kết quả AI đã làm.

Vai trò mới
  1. Thiết kế test caseAI tạo bản nháp
  2. Chọn case giao agent
  3. Điều phối phiên agenttheo dõi bảng tổng hợp
  4. Xác minh evidencetest tay case lỗi, case không chắc
  5. Quyết định đạt hay lỗi
  6. Bug report có evidence
Cả team Tester và team BA được đào tạo dùng bộ skill.

Kết quả

Theo đo lường nội bộ:

Thời gian thao tác lặp lại−70%
Phiên agent mỗi tester điều phối10–15thay vì 3–4 task thủ công mỗi ngày
Test case tự động đã viết1.000+cùng hàng trăm case thủ công
Tester chuyển sang quy trình mới4/4
  • Trước
  • Sau
  • Bug lặp lại trên cùng một module✓ 30% → 5%

    30%
    5%
Nhờ các case cũ được chạy lại sau mỗi thay đổi.

Trên dự án khách hàng Mỹ, đếm từ kho tài liệu dự án:

Test case tự động, 2 tuần cuối 09/2026901qua 31 lượt chạy; 9 case đạt giả bị chặn
Ticket thật để đúc kết bộ kit20+trong 6 ngày
Bẫy hay gặp được gom lại39từ khoảng 95 lỗi thực tế
Công cụ AI chạy được4Claude Code, Codex, OpenCode, Antigravity

Bộ kit đã bàn giao cho tester, kể cả một tester dùng Ubuntu, kèm hướng dẫn cho người không chuyên kỹ thuật.

Điều tôi học được

  • Người không viết code vẫn điều khiển được kiểm thử tự động nếu công cụ nói ngôn ngữ của họ: test case và evidence.
  • Agent không phải người quyết định đạt hay lỗi. Tester vẫn chịu trách nhiệm xác minh kết quả kiểm thử.
  • Tự động hoá giá trị nhất ở chỗ giải phóng thời gian cho phần việc cần con người: case khó và kiểm thử khám phá.
  • Test case
  • Integration test
  • Regression
  • Kiểm thử tự động
  • IDE agent
  • Governance

Muốn trao đổi về case này?

Liên hệ