Bài 3.1 — Token & Context

Model không đọc chữ. Nó đọc token.

Trước khi vào phòng thí nghiệm, hiểu đã. Ba phút đọc ở đây sẽ làm phần bấm nút có nghĩa hơn nhiều.

Model nhìn thấy gì khi bạn gõ một câu?

Không phải chữ cái. Không phải từ. Nó thấy token — những mẩu chữ do một bộ tokenizer băm ra trước khi đưa vào. Một LLM chỉ làm đúng một việc: nhìn dãy token đã có rồi đoán token tiếp theo.

Ví như: bạn đưa model tờ 500.000đ, nhưng nó chỉ tiêu được tiền lẻ. Token là những đồng tiền lẻ đó — và bộ tách token là cái máy đổi tiền.

Bấm nút để đổi thứ tiếng. Cùng một ý, tiếng Việt tốn gần gấp đôi token.

Vì sao chuyện này đáng quan tâm?

mọi thứ đều tính bằng token: số tiền bạn trả, tốc độ trả lời, và giới hạn độ dài. Cái giới hạn đó gọi là cửa sổ ngữ cảnh — sức chứa của model cho một lượt gọi.

Điều nhiều người không ngờ: cửa sổ ngữ cảnh không chỉ chứa câu hỏi của bạn. Nó chứa cả lời dặn hệ thống, cả lịch sử trò chuyện, cả tài liệu RAG kéo về, cả chỗ dành cho câu trả lời model sắp viết.

Kéo thanh trượt để trò chuyện dài thêm, rồi xem chuyện gì xảy ra khi đầy.

Và cái bạn gõ chỉ là một phần rất nhỏ của prompt

Giao diện ChatGPT giấu đi phần lớn những gì thật sự được gửi lên. Tab 4 và tab 5 của phòng thí nghiệm này sẽ cho bạn xem tận mắt cái prompt cuối cùng đó.

Vào phòng thí nghiệm để làm gì: gõ câu tiếng Việt của chính bạn, đếm token thật, so với tiếng Anh, và kéo thanh cửa sổ ngữ cảnh để thấy 128.000 token thật ra là bao nhiêu chữ.
AI Lab · khóa AI02 — AI Engineer Nền Tảng · SmartITSoft
Mọi con số trên trang này đều lấy từ model thật, không mô phỏng. Chỗ nào tính lại tại trình duyệt đều được ghi rõ.
Gặp chữ lạ? Mở 📖 Từ điển thuật ngữ — có hình động cho từng khái niệm.