Bài toán context window
Nếu Claude phải nạp toàn bộ nội dung của 50 skills vào mỗi cuộc hội thoại, context window sẽ cạn trước khi bạn kịp hỏi câu đầu tiên. Skills giải quyết bằng cơ chế nạp lũy tiến 3 tầng (progressive disclosure):
Tầng 1: Metadata (luôn trong context)
Khi khởi động, Claude chỉ thấy name + description của tất cả skills — mỗi skill tốn vài chục token. Giống như nhìn gáy sách trên kệ: biết có sách gì, chưa cần mở.
Tầng 2: Thân SKILL.md (nạp khi trigger)
Khi yêu cầu của user khớp với description, Claude mới mở sách — đọc toàn bộ phần thân SKILL.md để biết cách làm việc.
Tầng 3: File phụ (nạp khi cần đến)
Template, tài liệu tham khảo, script... chỉ được đọc khi bước thực thi cần đến chúng. Một skill có thể "nặng" hàng nghìn dòng tài liệu mà gần như không tốn context khi chưa dùng.
Context cost:
Tầng 1 ~30 token/skill → luôn luôn
Tầng 2 ~500-2000 token → khi skill được kích hoạt
Tầng 3 tùy file → khi từng file được cần
Hệ quả thiết kế quan trọng
- Description phải tự đứng được: Claude quyết định mở skill CHỈ dựa trên description — nếu viết mơ hồ, skill không bao giờ được dùng.
- Đẩy chi tiết xuống tầng sâu: SKILL.md nên là "mục lục + quy trình", chi tiết dài để ở file phụ.
- Không sợ skill dài: tách 1 skill khổng lồ thành SKILL.md gọn + nhiều file tham chiếu luôn tốt hơn nhồi tất cả vào một file.
💡 Tư duy: viết skill giống viết tài liệu onboarding cho nhân viên mới — bản tóm tắt 1 trang, kèm phụ lục tra cứu khi cần.
