08/05/2026 – (AIHanhChinhCong.vn) – Claude AI đang trở thành một trong những công cụ trí tuệ nhân tạo mạnh mẽ nhất cho viết nội dung, nghiên cứu, phân tích tài liệu, lập trình, tự động hóa quy trình và hỗ trợ công việc tri thức. Tuy nhiên, càng dùng sâu các công cụ như Claude Chat, Claude Cowork và Claude Code, người dùng càng dễ gặp tình trạng “hết hạn ngạch”, “reached usage limit”, hoặc cảm thấy gói Pro/Max vẫn chưa đủ cho nhu cầu hằng ngày.
Vấn đề không chỉ nằm ở việc “gói sử dụng thấp”, mà thường đến từ cách dùng chưa tối ưu: cuộc trò chuyện quá dài, tải file quá lớn, dùng model mạnh cho việc đơn giản, để Claude đọc lại quá nhiều ngữ cảnh, hoặc giao nhiệm vụ cho Claude Code/Cowork theo cách quá rộng. Theo hướng dẫn chính thức của Anthropic, hạn ngạch Claude chịu ảnh hưởng bởi độ dài tin nhắn, kích thước file đính kèm, độ dài cuộc trò chuyện, công cụ được sử dụng, lựa chọn model và cả việc tạo artifact [1].
Bài viết này hệ thống hóa cách dùng Claude theo tư duy chuyên nghiệp: không dùng ít hơn, mà dùng thông minh hơn.
1. Vì sao Claude nhanh hết hạn ngạch?
Claude không chỉ tính theo số câu hỏi. Mỗi lần người dùng gửi một yêu cầu, hệ thống phải xử lý nhiều thành phần: nội dung tin nhắn mới, lịch sử hội thoại, file đã đọc, công cụ được gọi, model đang dùng và phần phản hồi được tạo ra. Với Claude Code, Anthropic cho biết mỗi lượt làm việc có thể bao gồm: lịch sử cuộc trò chuyện, ngữ cảnh dự án như CLAUDE.md và các file Claude đã đọc, cùng prompt mới của người dùng [2].
Điều này tạo ra một “chi phí ngữ cảnh” rất quan trọng: cuộc trò chuyện càng dài, mỗi câu hỏi sau càng đắt. Một câu hỏi ngắn trong phiên làm việc đã kéo dài hàng chục lượt có thể tiêu tốn nhiều hạn ngạch hơn một câu hỏi dài nhưng nằm trong phiên mới, sạch và tập trung.
Có thể hình dung đơn giản:
| Tình huống sử dụng | Vì sao tốn hạn ngạch? | Cách tối ưu |
|---|---|---|
| Chat kéo dài nhiều giờ | Claude phải xử lý lại nhiều lịch sử hội thoại | Tách phiên theo từng nhiệm vụ |
| Upload file lớn nhiều lần | File làm tăng lượng context đầu vào | Dùng Project, chỉ đưa phần cần thiết |
| Dùng Opus cho việc đơn giản | Model mạnh tiêu hao hạn ngạch nhiều hơn | Chọn Sonnet/Haiku cho tác vụ nhẹ |
| Claude Code đọc cả repo | Công cụ đọc file, grep, bash tạo nhiều token | Chỉ rõ file, thư mục, dòng cần xử lý |
| Cowork xử lý thư mục lộn xộn | Agent phải tự tìm, đọc và suy luận quá rộng | Chuẩn hóa thư mục, manifest, brief |
2. Nguyên tắc nền tảng: quản trị context trước khi quản trị prompt
Nhiều người tập trung vào “prompt hay”, nhưng với Claude, đặc biệt là Claude Cowork và Claude Code, yếu tố quyết định hiệu quả lại là context sạch, đúng và vừa đủ. Anthropic khuyến nghị người dùng nên lên kế hoạch trước khi trò chuyện, gộp các yêu cầu liên quan, viết rõ ràng, tận dụng Project và tránh lặp lại thông tin không cần thiết [1].
Một công thức thực hành tốt là:
Context đúng + nhiệm vụ rõ + model phù hợp + đầu ra giới hạn = tiết kiệm hạn ngạch mà vẫn giữ chất lượng.
Thay vì hỏi:
“Hãy phân tích giúp tôi tất cả tài liệu này và đề xuất mọi thứ cần cải thiện.”
Nên hỏi:
“Dựa trên 3 trang tóm tắt đính kèm, hãy xác định 5 điểm nghẽn chính trong quy trình tiếp nhận hồ sơ trực tuyến. Trả lời dưới 700 từ, có bảng gồm: vấn đề, nguyên nhân, đề xuất cải tiến.”
Prompt thứ hai không chỉ rõ hơn, mà còn giúp Claude không phải “đi lang thang” trong dữ liệu.
3. Cách dùng Claude Chat tiết kiệm hạn ngạch
3.1. Bắt đầu bằng bản mô tả nhiệm vụ ngắn nhưng đủ
Claude Chat phù hợp cho viết nội dung, phân tích chính sách, tóm tắt tài liệu, tạo khung kế hoạch, soạn email, thiết kế bài giảng, viết kịch bản truyền thông và tư vấn quy trình. Muốn tiết kiệm hạn ngạch, nên gửi ngay từ đầu một “brief” rõ:
- Mục tiêu cần đạt.
- Độc giả hoặc người nhận.
- Dữ liệu đầu vào.
- Độ dài mong muốn.
- Định dạng đầu ra.
- Điều không được làm.
Ví dụ:
“Tôi cần viết bài 1.500 từ cho cán bộ hành chính công về ứng dụng AI trong cải cách thủ tục. Hãy lập dàn ý trước, dùng văn phong chuyên nghiệp, có ví dụ Việt Nam, không quảng cáo quá đà.”
Cách này giảm vòng hỏi đáp, hạn chế việc Claude phải sửa đi sửa lại nhiều lần.
3.2. Gộp các câu hỏi cùng nhóm
Anthropic khuyến nghị nên gộp các yêu cầu liên quan trong một tin nhắn thay vì tách thành nhiều lượt rời rạc [1]. Nếu cần Claude phân tích một báo cáo, thay vì hỏi 5 lần, có thể giao một lần:
- Tóm tắt 10 ý chính.
- Chỉ ra 5 rủi ro.
- Đề xuất 7 hành động ưu tiên.
- Viết lại thành bản trình bày cho lãnh đạo.
Điều quan trọng là các yêu cầu phải cùng một chủ đề. Nếu chuyển sang chủ đề khác, nên mở cuộc trò chuyện mới để tránh kéo theo ngữ cảnh cũ.
3.3. Dùng Project cho tài liệu lặp lại
Với các tài liệu dùng nhiều lần như quy chế, sổ tay thương hiệu, đề cương khóa học, quy trình nội bộ, nên đưa vào Claude Projects thay vì upload lặp lại ở nhiều cuộc trò chuyện. Anthropic cho biết nội dung trong Projects có lợi ích caching: khi tài liệu được dùng lại, chỉ phần mới hoặc chưa cache mới tác động đáng kể đến hạn ngạch [1].
Đây là nguyên tắc rất hữu ích cho cơ quan, trường học, doanh nghiệp và nhóm truyền thông: tài liệu nền tảng để trong Project; yêu cầu từng việc để trong Chat.
4. Cách dùng Claude Cowork thông minh
Claude Cowork có thể hiểu như một cách làm việc gần với “đồng nghiệp AI”: không chỉ trả lời, mà còn hỗ trợ xử lý tài liệu, tổ chức file, tạo đầu ra theo nhiệm vụ và làm việc theo ngữ cảnh dự án. Vì vậy, Claude Cowork dễ tốn hạn ngạch hơn Chat nếu người dùng giao việc quá rộng hoặc thư mục làm việc quá lộn xộn.
4.1. Chuẩn hóa thư mục trước khi giao việc
Một thư mục Cowork nên có cấu trúc đơn giản:
01-Brief/: mô tả nhiệm vụ, yêu cầu, tiêu chí hoàn thành.02-Input/: tài liệu đầu vào đã chọn lọc.03-Reference/: tài liệu tham khảo nền.04-Output/: nơi lưu kết quả._MANIFEST.md: mô tả mỗi file dùng để làm gì.
File _MANIFEST.md giúp Claude không phải tự đọc hoặc đoán toàn bộ thư mục. Với dự án có nhiều tài liệu, đây là cách giảm nhiễu, giảm token và tăng độ chính xác.
4.2. Không giao nhiệm vụ kiểu “đọc hết rồi làm gì đó”
Một lỗi phổ biến là yêu cầu:
“Đọc toàn bộ thư mục này và đề xuất kế hoạch chuyển đổi số.”
Câu này khiến Cowork phải quét rộng, đọc nhiều và suy luận dài. Nên chuyển thành:
“Chỉ đọc
_MANIFEST.md, sau đó đọc các file được đánh dấu ‘ưu tiên’. Tạo kế hoạch chuyển đổi số gồm 3 giai đoạn, mỗi giai đoạn có mục tiêu, việc cần làm, người phụ trách và sản phẩm đầu ra.”
Với Cowork, phạm vi càng rõ, hạn ngạch càng bền.
4.3. Tạo “luật làm việc” cố định
Người dùng nên chuẩn bị một file hướng dẫn như working-rules.md, gồm:
- Luôn hỏi lại nếu thiếu thông tin quan trọng.
- Không đọc file ngoài thư mục được chỉ định.
- Không tạo quá 3 phương án nếu không được yêu cầu.
- Không viết quá dài khi chưa có lệnh mở rộng.
- Luôn xuất kết quả vào
04-Output/.
Cách này biến Cowork từ “AI phản ứng” thành “AI làm việc theo quy trình”.
5. Cách dùng Claude Code tiết kiệm hạn ngạch tối đa
Claude Code là công cụ mạnh cho lập trình, đọc codebase, sửa lỗi, refactor, tạo test, viết tài liệu kỹ thuật và tự động hóa. Nhưng đây cũng là môi trường rất dễ tiêu hao hạn ngạch, vì agent có thể đọc file, chạy lệnh, phân tích lịch sử, dùng tool và tạo nhiều lượt xử lý.
5.1. Chọn model theo nhiệm vụ
Tài liệu Claude Code khuyến nghị Sonnet là lựa chọn mặc định cho phần lớn công việc lập trình vì cân bằng giữa năng lực, tốc độ và chi phí; Opus phù hợp với bài toán khó như refactor lớn, debug phức tạp hoặc quyết định kiến trúc; Haiku phù hợp với tra cứu nhanh, chỉnh sửa đơn giản hoặc chạy tác vụ khối lượng lớn [2].
| Loại nhiệm vụ | Model nên dùng | Lý do |
|---|---|---|
| Giải thích hàm, đổi tên biến, format code | Haiku | Nhanh, nhẹ, đủ dùng |
| Sửa bug thông thường, viết test, thêm feature nhỏ | Sonnet | Cân bằng chất lượng và hạn ngạch |
| Thiết kế kiến trúc, debug nhiều tầng, refactor lớn | Opus | Cần suy luận sâu |
| Lập kế hoạch bằng model mạnh, thực thi bằng model tiết kiệm | opusplan hoặc Opus → Sonnet | Tối ưu giữa chất lượng và chi phí |
Claude Code hỗ trợ lệnh /model để chuyển model trong phiên; tài liệu chính thức cũng mô tả alias như sonnet, opus, haiku, sonnet[1m], opus[1m] và opusplan, trong đó opusplan dùng Opus ở plan mode rồi chuyển sang Sonnet khi thực thi [3].
5.2. Dùng /clear và /compact đúng lúc
Claude Code có hai lệnh quan trọng để quản trị context:
/clear: xóa lịch sử trò chuyện và bắt đầu sạch khi chuyển nhiệm vụ./compact: nén lịch sử thành bản tóm tắt khi vẫn muốn tiếp tục cùng nhiệm vụ.
Theo hướng dẫn của Anthropic, lịch sử hội thoại là phần tăng nhanh nhất trong mỗi phiên Claude Code; /clear đặc biệt hữu ích khi chuyển sang nhiệm vụ mới vì giúp giảm chi phí và cải thiện chất lượng phản hồi [2].
Nguyên tắc thực hành:
- Hoàn thành một bug →
/clear. - Chuyển từ backend sang frontend →
/clear. - Đang làm một refactor dài nhưng chưa xong →
/compact. - Sau 30–60 phút làm việc liên tục → cân nhắc
/compact. - Khi thấy Claude bắt đầu chậm, lạc đề, nhắc lại nhiều → dọn context.
5.3. Rút gọn CLAUDE.md
CLAUDE.md nên là bộ nhớ dự án, không phải “sách giáo khoa”. Nếu file này quá dài, Claude phải mang theo quá nhiều thông tin trong mỗi lượt. Nên giữ:
- Mục tiêu dự án.
- Cấu trúc thư mục chính.
- Lệnh chạy, test, build.
- Quy tắc code quan trọng.
- Những điều cấm làm.
- Quy tắc chọn model nếu cần.
Ví dụ ngắn:
# CLAUDE.md
## Project
Next.js + TypeScript public service portal.
## Commands
- dev: pnpm dev
- test: pnpm test
- build: pnpm build
## Rules
- Do not edit .env, node_modules, dist.
- Use functional React components.
- Ask before changing database schema.
- Prefer Sonnet for coding; Opus only for architecture.
5.4. Dùng .claudeignore
Tương tự .gitignore, file .claudeignore giúp loại khỏi phạm vi đọc những thư mục hoặc file không cần thiết:
node_modules/
dist/
build/
coverage/
.git/
*.log
*.lock
.env
*.min.js
Điều này đặc biệt quan trọng với dự án lớn, vì Claude Code có thể tiêu hao nhiều context khi phải xét các file không liên quan. Tài liệu quản lý chi phí của Claude Code cũng nhấn mạnh các yếu tố như kích thước codebase, lựa chọn model, nhiều phiên chạy song song, automation và context management đều ảnh hưởng đến chi phí hoặc hạn ngạch [4].
5.5. Chỉ rõ file, dòng và phạm vi
Không nên nói:
“Hãy kiểm tra toàn bộ project xem lỗi ở đâu.”
Nên nói:
“Kiểm tra lỗi xác thực trong
src/api/auth.ts, tập trung vào hàmverifyToken()và middleware liên quan. Không đọc thư mụclegacy/.”
Hoặc:
“Chỉ đọc 120 dòng cuối của log và xác định nguyên nhân lỗi build.”
Với Claude Code, câu lệnh càng khoanh vùng, agent càng ít phải đọc lan man.
Sử dụng Claude hiệu quả không chỉ là hỏi giỏi, mà là biết quản trị ngữ cảnh, model, file và quy trình làm việc.
6. Bộ quy tắc 80/20 để tiết kiệm hạn ngạch Claude
Nếu chỉ nhớ 10 quy tắc, hãy nhớ:
- Mỗi nhiệm vụ một phiên làm việc: không kéo dài chat cho nhiều chủ đề.
- Dọn context thường xuyên: dùng
/clearkhi đổi việc,/compactkhi tiếp tục việc dài. - Không upload file thừa: chỉ đưa phần cần xử lý.
- Dùng Project cho tài liệu lặp lại.
- Dùng Sonnet làm mặc định, Opus chỉ dùng cho việc thật khó.
- Dùng Haiku cho việc nhẹ như tóm tắt ngắn, đổi định dạng, tra cứu nhanh.
- Luôn yêu cầu đầu ra có giới hạn: số từ, số mục, bảng, checklist.
- Tránh prompt mơ hồ như “phân tích toàn diện tất cả”.
- Tạo manifest cho thư mục lớn.
- Theo dõi usage bằng các công cụ có sẵn như
/usage,/cost,/statustùy môi trường [2][4].
7. Mẫu prompt tiết kiệm hạn ngạch
Mẫu cho Claude Chat
Tôi cần [kết quả cụ thể] cho [đối tượng].
Dữ liệu đầu vào gồm [mô tả ngắn].
Hãy trả lời theo cấu trúc: [mục 1], [mục 2], [mục 3].
Giới hạn trong [số từ].
Nếu thiếu thông tin quan trọng, hãy hỏi tối đa 3 câu trước khi làm.
Mẫu cho Claude Cowork
Chỉ đọc
_MANIFEST.mdtrước.
Sau đó đọc các file được đánh dấu “ưu tiên”.
Nhiệm vụ: tạo [sản phẩm đầu ra].
Không đọc thư mục ngoài phạm vi.
Nếu cần thêm thông tin, hãy hỏi trước khi thực hiện.
Lưu kết quả vào04-Output/.
Mẫu cho Claude Code
Dùng Sonnet.
Kiểm tra filesrc/api/auth.ts, tập trung vào hàmverifyToken().
Không đọc toàn bộ repo.
Trước khi sửa, hãy nêu kế hoạch 5 gạch đầu dòng.
Sau khi sửa, chạy test liên quan và báo cáo ngắn: lỗi, thay đổi, kết quả test.
8. Ứng dụng cho hành chính công, giáo dục và chuyển đổi số
Trong khu vực công, giáo dục và quản trị tổ chức, Claude có thể hỗ trợ rất mạnh cho:
- Soạn thảo kế hoạch chuyển đổi số.
- Tóm tắt văn bản chính sách.
- Thiết kế quy trình phục vụ người dân.
- Phân tích phản hồi của công dân/học viên.
- Tạo tài liệu hướng dẫn nội bộ.
- Hỗ trợ xây chatbot, trợ lý AI, hệ thống tra cứu văn bản.
- Viết mã cho prototype dịch vụ số.
Tuy nhiên, để triển khai chuyên nghiệp, không nên xem Claude là “hộp chat hỏi gì đáp nấy”, mà nên xem là hệ thống làm việc có cấu trúc. Nếu cơ quan, trường học hoặc doanh nghiệp cần xây dựng quy trình khai thác AI bài bản, TS. Nguyễn Trung Hòa và AIHanhChinhCong.vn có thể đồng hành trong việc thiết kế workflow, chuẩn hóa dữ liệu, xây dựng trợ lý AI nội bộ và huấn luyện đội ngũ sử dụng AI hiệu quả, an toàn, tiết kiệm.
Sử dụng Claude AI tiết kiệm hạn ngạch không có nghĩa là dùng ít đi, mà là dùng đúng cách hơn. Với Claude Chat, hãy quản trị cuộc trò chuyện và tài liệu. Với Claude Cowork, hãy chuẩn hóa thư mục, manifest và luật làm việc. Với Claude Code, hãy kiểm soát model, context, file đọc, lệnh /clear, /compact, CLAUDE.md và .claudeignore.
Trong kỷ nguyên AI tác nhân, người dùng chuyên nghiệp không chỉ biết đặt câu hỏi hay, mà còn biết thiết kế môi trường làm việc cho AI. Ai làm chủ được context, người đó làm chủ được chất lượng, chi phí và tốc độ triển khai.
Tài liệu tham khảo
[1] Anthropic. (2026, March 16). Usage limit best practices. Claude Help Center. https://support.claude.com/en/articles/9797557-usage-limit-best-practices
[2] Anthropic. (2026, April 15). Models, usage, and limits in Claude Code. Claude Help Center. https://support.claude.com/en/articles/14552983-models-usage-and-limits-in-claude-code
[3] Anthropic. (2026). Model configuration. Claude Code Docs. https://code.claude.com/docs/en/model-config
[4] Anthropic. (2026). Manage costs effectively. Claude Code Docs. https://code.claude.com/docs/en/costs
[5] Patterson, B. (2026, March 27). Switching to Claude? These 4 habits help you avoid hitting usage caps. PCWorld. https://www.pcworld.com/article/3099983/switching-to-claude-these-4-habits-help-you-avoid-hitting-usage-caps.html

