Checklist chuẩn hoá skill claude ai — Bài 9 · Claude Wiki
Bài 09Phần 4 · Chuẩn hoá

Checklist chuẩn hoá
4 mốc kiểm tra

Checklist chuẩn hoá skill Claude AI theo bốn mốc: trước khi code, trong lúc dev, trước khi upload và sau khi upload.

🎯 Mục tiêu bài học

  • Chạy đủ 4 mốc kiểm tra trước khi phát hành một skill.
  • Dùng checklist chất lượng cốt lõi của Anthropic để rà soát nội dung.
  • Rà soát riêng phần script và phần kiểm thử trước khi chia sẻ.
  • Đo lường skill sau khi phát hành và biết khi nào cần sửa.
BỐN MỐC

Dừng lại kiểm tra ở đúng bốn thời điểm này

1

1. Trước khi code

Đã xác định được 2-3 use case cụ thể và có lặp lại chưa? Đã viết ra Trigger Phrase, Core Steps và Expected Result chưa? Đã có ít nhất 3 kịch bản đánh giá và đo baseline khi chưa có skill chưa?

2

2. Trong lúc dev

Tên thư mục có đúng kebab-case không? File chính có đúng SKILL.md viết hoa toàn bộ không? Frontmatter có đúng và chỉ đúng 6 trường hợp lệ không? Thân file có dưới 500 dòng không?

3

3. Trước khi upload

Chạy test với 5 cách diễn đạt khác nhau để bảo đảm trigger chuẩn. Chạy thêm vài yêu cầu không liên quan để chắc chắn skill không bắt nhầm. Đọc lại toàn bộ file script bundle kèm theo.

4

4. Sau khi upload

Đo tỷ lệ trigger thực tế — mục tiêu phải đạt trên 90%. Quan sát Claude thực sự điều hướng skill thế nào: có đọc file theo thứ tự bạn dự đoán không, có bỏ qua file nào không.

CHECKLIST CHẤT LƯỢNG CỐT LÕI

Rà soát nội dung trước khi chia sẻ

✓ Description

Cụ thể, có từ khoá thực tế người dùng gõ. Nói cả skill làm gìkhi nào dùng. Viết ngôi thứ ba.

✓ Độ dài

Thân SKILL.md dưới 500 dòng. Chi tiết bổ sung đã tách ra file riêng.

✓ Thời gian tính

Không có thông tin gắn mốc ngày tháng, hoặc đã gói trong mục "Pattern cũ".

✓ Thuật ngữ

Nhất quán xuyên suốt. Không trộn nhiều từ cho cùng một khái niệm.

✓ Ví dụ

Cụ thể, không trừu tượng. Có cặp đầu vào và đầu ra nếu chất lượng phụ thuộc định dạng.

✓ Tham chiếu

Mọi file link trực tiếp từ SKILL.md, chỉ một tầng. File dài trên 100 dòng có mục lục.

✓ Quy trình

Các bước rõ ràng, có checklist để Claude tự đánh dấu tiến độ nếu quy trình dài.

✓ Tiết lộ lũy tiến

Đã dùng đúng cách — nội dung hiếm dùng nằm ở file riêng, không nhét hết vào file chính.

CHECKLIST SCRIPT VÀ KIỂM THỬ

Hai nhóm rà soát còn lại

A

Mã và script

□ Script tự giải quyết vấn đề thay vì đùn đẩy cho Claude
□ Xử lý lỗi tường minh và có thông báo hữu ích
□ Không có hằng số bí ẩn — mọi giá trị đều được giải thích
□ Đã liệt kê package cần thiết và xác nhận có sẵn trong môi trường
□ Không dùng đường dẫn kiểu Windows — toàn bộ dấu gạch chéo xuôi
□ Có bước validation cho các thao tác quan trọng

B

Kiểm thử

□ Đã tạo tối thiểu 3 kịch bản đánh giá
□ Đã test với Haiku, Sonnet và Opus — mọi model bạn định dùng
□ Đã test với kịch bản sử dụng thật, không chỉ ví dụ mẫu
□ Đã thu thập phản hồi từ đồng nghiệp nếu skill dùng chung
□ Đã đo tỷ lệ trigger và so với baseline không có skill

ĐO LƯỜNG SAU PHÁT HÀNH

Bốn tín hiệu cho biết skill cần sửa

Quan sát đượcNghĩa là gìNên làm gì
Claude đọc file theo thứ tự bạn không ngờ tớiCấu trúc skill không trực quan như bạn tưởngSắp xếp lại thứ tự các mục trong SKILL.md
Claude không đi theo link tới file quan trọngLink chưa đủ rõ hoặc chưa đủ nổi bậtViết link tường minh hơn, đưa lên vị trí cao hơn
Claude đọc đi đọc lại cùng một fileNội dung đó thực ra nên nằm ngay trong SKILL.mdChuyển nội dung đó vào file chính
Có file trong bundle Claude không bao giờ chạm tớiFile thừa, hoặc chưa được giới thiệu trong hướng dẫn chínhXoá bớt, hoặc thêm link rõ ràng từ SKILL.md
📊
Đo bằng quan sát, không bằng phỏng đoánĐừng hỏi Claude "skill này có hữu ích không" — hãy quan sát Claude thực sự dùng skill thế nào trong tác vụ thật. Tài liệu Anthropic nhấn mạnh: lặp lại dựa trên hành vi quan sát được, không dựa trên giả định. Bộ đánh giá của bạn mới là nguồn chân lý về hiệu quả của skill.
CÂU HỎI THƯỜNG GẶP

FAQ — 3 câu hỏi thường gặp về checklist chuẩn hoá skill claude ai

Bốn mốc kiểm tra một skill là gì?

Trước khi code — đã có 2-3 use case cụ thể và bộ đánh giá chưa. Trong lúc dev — kebab-case, SKILL.md đúng hoa thường, thân file dưới 500 dòng. Trước khi upload — test 5 cách diễn đạt. Sau khi upload — đo tỷ lệ trigger thực tế.

Tỷ lệ trigger bao nhiêu là đạt?

Trên 90%. Test bằng ít nhất 5 cách diễn đạt khác nhau cho cùng một yêu cầu, đồng thời gõ vài yêu cầu không liên quan để chắc chắn skill không bắt nhầm.

Có nên test skill với nhiều model không?

Có — test với mọi model bạn định dùng. Skill là phần bổ sung cho model nên hiệu quả phụ thuộc model bên dưới. Với Haiku hãy hỏi "hướng dẫn đã đủ chi tiết chưa"; với Opus hỏi "có đang giải thích thừa không".

Nguồn: Bài viết biên soạn dựa trên tài liệu Xây dựng bộ Skills cho Claude (Anthropic Academy, bản tiếng Việt do Nguyen Ngoc Tuan trình bày), đã viết lại và đối chiếu với tài liệu Agent Skills chính thức của Anthropic (platform.claude.com và code.claude.com), cập nhật 15/08/2026. Mọi số liệu kỹ thuật lấy theo tài liệu chính thức.