CYBERSOFT
Đăng nhập

Ngân hàng câu hỏi phỏng vấn 'AI trong kiểm thử' theo cấp: junior → lead (2026)

Chuyên phỏng vấnDịch vụ SaaSAI AgentPhỏng vấnKinh nghiệmNền tảng
🗓 1 tháng trước21 phút đọc·👁 232 lượt xem👤 416 người đọc

Ngân hàng câu hỏi phỏng vấn AI-in-testing chia bốn cấp (junior/mid/senior/lead): nền tảng (AI làm được/không, hallucination, oracle problem), công cụ (Playwright Agents/MCP, self-healing, visual AI, LLM eval), câu hỏi tình huống & thiết kế hệ thống, metrics & chiến lược, đạo đức & an toàn dữ liệu. Mỗi câu có câu trả lời mẫu ba ngôn ngữ và 'điều người phỏng vấn tìm kiếm'.

1. Cách dùng ngân hàng câu hỏi này và bốn cấp năng lực

Năm 2026, gần như mọi buổi phỏng vấn tester đều có ít nhất vài câu về AI trong kiểm thử. Nhà tuyển dụng không kỳ vọng bạn thuộc lòng mọi công cụ, mà muốn thấy bạn tư duy đúng: biết AI làm được gì, giới hạn ở đâu, và làm sao dùng AI mà vẫn giữ chất lượng kiểm thử. Ngân hàng câu hỏi này chia theo bốn cấp — junior, mid, senior, lead — vì cùng một chủ đề nhưng câu trả lời kỳ vọng khác nhau theo cấp. Mỗi câu đi kèm câu trả lời mẫu và phần 'điều người phỏng vấn tìm kiếm', để bạn không chỉ nói đúng mà còn hiểu vì sao câu trả lời đó được đánh giá cao.

Bốn cấp năng lực AI-in-Testing mà người phỏng vấn đo JUNIORhiểu AI làm được/không được · hallucination · biết dùng công cụ có giám sát MIDoracle problem · viết test có AI hỗ trợ · review đầu ra AI · self-healing · visual AI SENIORthiết kế hệ thống test AI-native · LLM eval · ngân sách token · ranh giới người/máy LEADchiến lược · metrics · rủi ro · đạo đức & an toàn dữ liệu · dẫn dắt đội áp dụng AI
Bốn cấp năng lực AI-in-Testing và trọng tâm mỗi cấp.
  • Junior: nền tảng — AI làm được/không được, hallucination, dùng công cụ có giám sát.
  • Mid: oracle problem, review đầu ra AI, self-healing, visual AI, viết test có AI hỗ trợ.
  • Senior: thiết kế hệ thống test AI-native, LLM eval, ngân sách token, ranh giới người/máy.
  • Lead: chiến lược, metrics, quản trị rủi ro, đạo đức và an toàn dữ liệu, dẫn dắt áp dụng.
💡 Khi trả lời, luôn neo vào ví dụ cụ thể bạn từng làm. 'Tôi từng dùng self-healing để giảm bảo trì locator, nhưng vẫn giữ oracle nghiệp vụ do người viết' mạnh hơn nhiều so với định nghĩa suông.

2. Cấp Junior: AI làm được gì và KHÔNG làm được gì

Ở cấp junior, người phỏng vấn kiểm tra nền tảng tư duy: bạn có hiểu đúng bản chất của AI trong kiểm thử, hay chỉ lặp lại từ khoá thời thượng. Câu hỏi thường xoay quanh việc phân định rạch ròi giữa những gì AI hỗ trợ tốt và những gì vẫn thuộc về con người. Một junior giỏi không thần thánh hoá AI cũng không phủ nhận nó, mà mô tả được một bức tranh cân bằng: AI tăng tốc phần cơ học, con người giữ phần phán đoán. Điều tối kỵ ở cấp này là trả lời kiểu 'AI sẽ thay thế tester', vì nó cho thấy thiếu hiểu biết về oracle và trách nhiệm.

Theo bạn, AI trong kiểm thử làm tốt việc gì và chưa làm được việc gì?

AI làm tốt phần cơ học và lặp lại: sinh nháp test, gợi ý locator, tự sửa locator lỗi thời (self-healing), so sánh ảnh giao diện (visual), tóm tắt log/trace, sinh dữ liệu test. Những việc này AI nhanh hơn người nhiều lần. AI chưa làm tốt phần phán đoán: định nghĩa oracle nghiệp vụ (đâu là 'đúng'), quyết định rủi ro nào đáng ưu tiên, hiểu ngữ cảnh doanh nghiệp, và chịu trách nhiệm khi phát hành. AI cũng có thể hallucinate — bịa ra bước hay API không tồn tại. Vì vậy tôi coi AI là trợ lý tăng tốc, còn quyết định cuối và oracle vẫn do người giữ.

Hallucination là gì và vì sao nó nguy hiểm trong kiểm thử?

Hallucination là khi mô hình ngôn ngữ sinh ra nội dung nghe hợp lý nhưng sai hoặc không có thật — ví dụ bịa ra một phương thức API, một selector không tồn tại, hay một bước thao tác không đúng. Trong kiểm thử, nó nguy hiểm vì một test 'trông đúng' có thể không bao giờ chạy được, hoặc tệ hơn, chạy xanh nhưng kiểm sai thứ. Cách phòng là grounding: cho AI xác minh trên ứng dụng thật trước khi tin, và luôn để người review đầu ra AI thay vì merge mù. Tôi không bao giờ tin một locator AI đề xuất cho tới khi nó được kiểm trên app đang chạy.

Từ khoá junior nên nắm chắc: hallucination, grounding, oracle, self-healing, visual testing, human-in-the-loop. Hiểu bản chất quan trọng hơn thuộc định nghĩa.

3. Cấp Mid: oracle problem — trái tim của kiểm thử AI

Oracle problem là câu hỏi kinh điển của kiểm thử: làm sao biết một kết quả là đúng hay sai? Trong kỷ nguyên AI, câu hỏi này trở nên sắc bén hơn bao giờ hết, vì AI có thể sinh ra rất nhiều test một cách rẻ và nhanh, nhưng lại không tự biết đâu là 'đúng' theo nghĩa nghiệp vụ. Một mô hình dễ dàng assert những thứ luôn đúng như 'nút hiển thị' hay 'có thông báo thành công', vốn xanh mà chẳng bắt được lỗi. Ở cấp mid, người phỏng vấn muốn thấy bạn hiểu rằng giá trị con người nằm ở việc định nghĩa oracle — bất biến nghiệp vụ — chứ không phải ở tốc độ gõ test.

Oracle problem: vì sao AI không tự biết "đúng" nghĩa là gì AI dễ làm • sinh nháp test nhanh • assert "có toast success" • assert "nút hiển thị" → xanh mà không bắt lỗi → hallucinate bước/locator Người định nghĩa oracle ✓ tồn kho không âm ✓ tiền bảo toàn (bút toán kép) ✓ retry → 1 trạng thái (冪等性) ✓ tenant A ≠ thấy tenant B ✓ RBAC theo bảng quyết định Giá trị con người = định nghĩa "đúng" mà máy không tự suy ra được
Oracle problem: máy sinh test rẻ, nhưng người định nghĩa 'đúng'.
ts
// Ví dụ minh hoạ oracle YẾU vs oracle MẠNH cho cùng một luồng thanh toán.
import { test, expect } from '@playwright/test';

test('oracle YẾU — xanh mà vô nghĩa', async ({ page }) => {
  await page.getByRole('button', { name: 'Đặt hàng' }).click();
  // ❌ luôn đúng, không bắt được lỗi nghiệp vụ nào
  await expect(page.getByText('Thành công')).toBeVisible();
});

test('oracle MẠNH — kiểm bất biến nghiệp vụ', async ({ page, request }) => {
  const before = await getStock(request, 'SKU-001');
  await page.getByRole('button', { name: 'Đặt hàng' }).click();
  await expect(page.getByRole('status')).toHaveText(/PAID/);
  // ✓ tồn kho giảm đúng 1; ✓ số tiền trừ = tổng đơn; ✓ đúng 1 đơn tạo ra
  expect(await getStock(request, 'SKU-001')).toBe(before - 1);
  expect(await orderCount(request, { cart: 'C1' })).toBe(1);
});

Oracle problem là gì, và AI thay đổi nó như thế nào?

Oracle problem là bài toán: làm sao xác định output của hệ thống là đúng hay sai. Oracle là nguồn 'chân lý' để so sánh — có thể là đặc tả, bất biến nghiệp vụ, hay hành vi mong đợi. AI không thay đổi bản chất bài toán mà làm nó nổi bật hơn: vì AI sinh test cực rẻ, nút thắt dịch chuyển từ 'viết test' sang 'định nghĩa oracle đúng'. AI dễ tạo assertion hời hợt luôn xanh; giá trị của tester chuyển sang việc dạy AI, qua kế hoạch và review, đâu là bằng chứng thật của tính đúng đắn — như tồn kho không âm, tiền bảo toàn, idempotency. Nói ngắn: AI viết test nhanh, người định nghĩa 'đúng'.

🎯 Bài tập thực hành thường gặp ở vòng mid

Người phỏng vấn đưa một test do AI sinh chỉ assert 'toBeVisible' cho toast success, rồi hỏi: 'Test này có vấn đề gì?'. Câu trả lời tốt: test này có oracle yếu, luôn xanh kể cả khi nghiệp vụ sai — ví dụ đơn được tạo nhưng tồn kho không giảm, hay tạo trùng hai đơn. Tôi sẽ thêm oracle bất biến: so tồn kho trước/sau, kiểm số đơn đúng bằng một, đối chiếu số tiền trừ với tổng đơn. Người phỏng vấn muốn thấy bạn không dừng ở 'trông xanh là được' mà biết chất vấn xem test có thực sự bảo vệ nghiệp vụ không.

4. Cấp Mid: công cụ — Playwright Agents, MCP, self-healing

Ở cấp mid, người phỏng vấn muốn bạn không chỉ biết tên công cụ mà hiểu chúng làm gì, khi nào dùng, và giới hạn của chúng. Playwright Agents gồm ba tác nhân hợp tác: Planner khám phá app và viết test plan Markdown, Generator biến plan thành spec chạy được với locator đã verify, Healer chạy debug để tự chữa test hỏng. Playwright MCP cho phép một mô hình như Claude lái trình duyệt qua cây accessibility bằng chỉ dẫn ngôn ngữ tự nhiên. Self-healing tự sửa locator lỗi thời khi UI đổi. Câu trả lời tốt luôn kèm ranh giới: những công cụ này sinh nháp và giảm bảo trì, nhưng oracle và quyết định merge vẫn thuộc con người.

🔒

Nội dung bị khoá

Bạn đang xem bản xem trước. Đăng nhập để mở khoá toàn bộ bài viết và tất cả tài liệu Tester/QA.

Đã xem 25% nội dung
  • Đọc trọn vẹn mọi bài viết
  • Lưu bài & ghi chú cá nhân
  • Theo dõi tiến độ đã đọc
  • Luyện phỏng vấn, ISTQB, Mock
Đăng nhập để đọc tiếp

Chưa có mã? Lấy mã qua Fanpage / Zalo CyberSoft.

0

💬 Bình luận (0)

Bạn có thể đọc mọi bình luận. Đăng nhập để bình luận

Chưa có bình luận nào. Hãy là người đầu tiên!