Dữ liệu:652 mô hình
|
+BẠN PHÁT TRIỂN SẢN PHẨM. CHÚNG TÔI ĐO LƯỜNG VÀ GIÁM SÁT CÁC MÔ HÌNH AI.+
DỮ LIỆU ĐỘC LẬP • 652+ MÔ HÌNH

Chọn đúng mô hình AI bằng số liệu thực chứng và minh bạch

Đừng chọn AI theo cảm tính. ModelTier mang đến chuẩn đo lường độc lập — phân hạng trực quan, quy đổi chi phí ra VNĐ và đo lường độ nhuyễn tiếng Việt thực chiến.

Khám Phá Mô Hình Tinh Hoa

Tiêu Điểm Tinh Hoa (Top Highlights)

Đo lường độc lập trên phần cứng chuyên dụng • Cập nhật trực tiếp
Top 11

Độ Thông Minh

Điểm chuẩn Intelligence Index • Càng cao càng tốt
Claude Fable 5.1 (max with fallback)
53.4
GPT-6 Astra (max)
52.8
Claude Opus 5 (max)
50.7
Muse Spark 1.3 (max)
48.2
GLM-5.3 (max)
44.9
Grok 4.6 (high)
44.4
Kimi K3 (max)
43.8
Gemini 3.8 Flash (high)
41.2
DeepSeek V4.1 Flash (max)
39.5
GPT-5.6 Luna (max)
37.5
DeepSeek V4 Pro 0813 (max)
36.3
Mô hình dẫn đầu: Claude Fable 5.1 (max with fallback)
Top 11

Tốc Độ Phản Hồi

Số token sinh ra mỗi giây (TPS) • Càng cao càng tốt
Gemini 3.8 Flash (high)
341 tps
Muse Spark 1.3 (max)
238 tps
DeepSeek V4.1 Flash (max)
221 tps
GPT-5.6 Luna (max)
119 tps
DeepSeek V4 Pro 0813 (max)
89 tps
Claude Fable 5.1 (max with fallback)
67 tps
GLM-5.3 (max)
67 tps
Grok 4.6 (high)
65 tps
GPT-6 Astra (max)
53 tps
Claude Opus 5 (max)
52 tps
Kimi K3 (max)
36 tps
Nhanh nhất hiện nay: Gemini 3.8 Flash (high)
Top 11

Chi Phí Tác Vụ

Chi phí chạy 1 tác vụ chuẩn hóa • Càng thấp càng rẻ
GPT-5.6 Luna (max)
4.538 ₫
DeepSeek V4.1 Flash (max)
6.750 ₫
DeepSeek V4 Pro 0813 (max)
17.154 ₫
Gemini 3.8 Flash (high)
31.629 ₫
Muse Spark 1.3 (max)
40.845 ₫
Grok 4.6 (high)
47.310 ₫
Kimi K3 (max)
50.903 ₫
GLM-5.3 (max)
51.043 ₫
GPT-6 Astra (max)
82.903 ₫
Claude Opus 5 (max)
149.096 ₫
Claude Fable 5.1 (max with fallback)
194.176 ₫
Tiết kiệm nhất: GPT-5.6 Luna (max)
Nhận xét từ ModelTier: Các mô hình suy luận sâu (Reasoning models) đang dẫn đầu tuyệt đối về trí tuệ và lập trình, tuy nhiên các dòng Flash/Mini lại có tốc độ vượt trội gấp 3–5 lần với chi phí tiết kiệm hơn 80%.
Đồ Thị Tọa Độ: Trí Tuệ vs Tốc ĐộPareto Frontier

Đồ thị phân tán 2 chiều trực quan với đường biên hiệu quả Pareto

2030405050100150200250300350Độ thông minh (Intelligence Index)Tốc độ sinh chữ (Tokens/s) →Claude Fable 5.1Claude Fable 5.1Claude Fable 5.1Claude Opus 5Claude Fable 5Claude Opus 5Claude Fable 5.1Claude Opus 5Claude Fable 5.1Claude Opus 5GPT-6 AstraGPT-6 AstraGPT-6 AstraGPT-6 AstraGPT-5.6 SolGPT-6 AstraGPT-5.6 Solgpt-oss-20bMuse Spark 1.3Muse Spark 1.3Qwen3.8 MaxQwen3.5 Omni FlashGLM-5.3Grok 4.6Grok 4.6Kimi K3Gemini 3.8 FlashGemini 3.7 FlashGemini 3.7 FlashGemini 3.7 FlashGemini 3.5 FlashGemini 3.5 FlashGemini 3.5 Flash-LiteDeepSeek V4.1 FlashDeepSeek V4 Flash VisionAgnes 3.0 FlashLing 3.0 FlashNemotron 3.5 LightningMinistral 3 3BNova MicroCommand A+Mercury 2Trinity Large ThinkingCeleris-1
💡 Hướng dẫn phân tích đường biên Pareto: Các mô hình nằm sát đường biên Pareto (góc trên bên phải) là những mô hình "vừa thông minh đỉnh cao lại vừa sinh chữ siêu tốc" (như Gemini 2.5 Flash, Groq Llama 3.3, Claude 3.7 Sonnet)!
Phân Hạng Thực Tiễn 2026

Bảng Xếp Hạng Tier Thực Chiến

Phân hạng từ siêu cấp (S-Tier) đến phổ thông, dựa trên hiệu năng thực tế tại Việt Nam

S

S-Tier (Thần Thoại / Đỉnh Cao)

Thông minh nhất thế giới, lý luận siêu phàm, giải toán và viết code chuyên gia.

20 mô hình
Anthropic

Claude Fable 5.1 (max with fallback)

S

Mô hình AI Claude Fable 5.1 (max with fallback) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 53/100 với tốc độ 67 tokens/s.

Độ thông minh
53.0
Tiếng Việt
98/100
Tốc độ67 tps
Giá đầu ra$9.16/1M
Anthropic

Claude Fable 5.1 (xhigh with fallback)

S

Mô hình AI Claude Fable 5.1 (xhigh with fallback) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 53/100 với tốc độ 58 tokens/s.

Độ thông minh
53.0
Tiếng Việt
98/100
Tốc độ58 tps
Giá đầu ra$7.18/1M
Anthropic

Claude Fable 5.1 (high with fallback)

S

Mô hình AI Claude Fable 5.1 (high with fallback) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 51/100 với tốc độ 58 tokens/s.

Độ thông minh
51.0
Tiếng Việt
98/100
Tốc độ58 tps
Giá đầu ra$4.69/1M
Anthropic

Claude Opus 5 (max)

S

Mô hình AI Claude Opus 5 (max) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 51/100 với tốc độ 52 tokens/s.

Độ thông minh
51.0
Tiếng Việt
98/100
Tốc độ52 tps
Giá đầu ra$7.03/1M
Anthropic

Claude Fable 5 (with fallback)

S

Mô hình AI Claude Fable 5 (with fallback) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 50/100 với tốc độ 68 tokens/s.

Độ thông minh
50.0
Tiếng Việt
98/100
Tốc độ68 tps
Giá đầu ra$10.50/1M
Anthropic

Claude Opus 5 (xhigh)

S

Mô hình AI Claude Opus 5 (xhigh) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 50/100 với tốc độ 54 tokens/s.

Độ thông minh
50.0
Tiếng Việt
98/100
Tốc độ54 tps
Giá đầu ra$5.86/1M
A

A-Tier (Chiến Thần Đa Năng)

Cân bằng hoàn hảo giữa tốc độ, độ thông minh và chi phí. Lựa chọn số 1 cho 90% nhu cầu.

195 mô hình
Anthropic

Claude Opus 4.8 (Adaptive Reasoning, Max Effort)

A

Mô hình AI Claude Opus 4.8 (Adaptive Reasoning, Max Effort) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 39/100 với tốc độ 60 tokens/s.

Độ thông minh
39.0
Tiếng Việt
96/100
Tốc độ60 tps
Giá đầu ra$0.60/1M
Anthropic

Claude Opus 4.7 (Adaptive Reasoning, Max Effort)

A

Mô hình AI Claude Opus 4.7 (Adaptive Reasoning, Max Effort) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 39/100 với tốc độ 60 tokens/s.

Độ thông minh
39.0
Tiếng Việt
96/100
Tốc độ60 tps
Giá đầu ra$0.60/1M
Anthropic

Claude Opus 5 (low)

A

Mô hình AI Claude Opus 5 (low) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 40/100 với tốc độ 50 tokens/s.

Độ thông minh
40.0
Tiếng Việt
96/100
Tốc độ50 tps
Giá đầu ra$1.32/1M
Anthropic

Claude Sonnet 5 (max)

A

Mô hình AI Claude Sonnet 5 (max) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 38/100 với tốc độ 74 tokens/s.

Độ thông minh
38.0
Tiếng Việt
96/100
Tốc độ74 tps
Giá đầu ra$6.11/1M
Anthropic

Claude Sonnet 5 (xhigh)

A

Mô hình AI Claude Sonnet 5 (xhigh) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 35/100 với tốc độ 67 tokens/s.

Độ thông minh
35.0
Tiếng Việt
96/100
Tốc độ67 tps
Giá đầu ra$3.44/1M
Anthropic

Claude Opus 4.6 (Adaptive Reasoning, Max Effort)

A

Mô hình AI Claude Opus 4.6 (Adaptive Reasoning, Max Effort) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 39/100 với tốc độ 60 tokens/s.

Độ thông minh
39.0
Tiếng Việt
96/100
Tốc độ60 tps
Giá đầu ra$0.60/1M
B

B-Tier (Tia Chớp Giá Rẻ)

Tốc độ cực nhanh, giá siêu rẻ hoặc miễn phí. Lý tưởng cho xử lý dữ liệu hàng loạt và CSKH.

256 mô hình
Anthropic

Claude Sonnet 5 (high)

B

Mô hình AI Claude Sonnet 5 (high) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 32/100 với tốc độ 64 tokens/s.

Độ thông minh
32.0
Tiếng Việt
96/100
Tốc độ64 tps
Giá đầu ra$2.15/1M
Anthropic

Claude Opus 4.7 (Non-reasoning, High Effort)

B

Mô hình AI Claude Opus 4.7 (Non-reasoning, High Effort) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 25/100 với tốc độ 60 tokens/s.

Độ thông minh
25.0
Tiếng Việt
96/100
Tốc độ60 tps
Giá đầu ra$0.60/1M
Anthropic

Claude Sonnet 5 (Non-reasoning)

B

Mô hình AI Claude Sonnet 5 (Non-reasoning) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 29/100 với tốc độ 66 tokens/s.

Độ thông minh
29.0
Tiếng Việt
96/100
Tốc độ66 tps
Giá đầu ra$0.60/1M
Anthropic

Claude Sonnet 5 (medium)

B

Mô hình AI Claude Sonnet 5 (medium) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 28/100 với tốc độ 64 tokens/s.

Độ thông minh
28.0
Tiếng Việt
96/100
Tốc độ64 tps
Giá đầu ra$1.20/1M
Anthropic

Claude Opus 4.6 (Non-reasoning, High Effort)

B

Mô hình AI Claude Opus 4.6 (Non-reasoning, High Effort) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 25/100 với tốc độ 60 tokens/s.

Độ thông minh
25.0
Tiếng Việt
96/100
Tốc độ60 tps
Giá đầu ra$0.60/1M
Anthropic

Claude Sonnet 5 (low)

B

Mô hình AI Claude Sonnet 5 (low) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 25/100 với tốc độ 65 tokens/s.

Độ thông minh
25.0
Tiếng Việt
96/100
Tốc độ65 tps
Giá đầu ra$0.61/1M
C

C-Tier (Cơ Bản / Nhỏ Gọn)

Mô hình nhỏ gọn chạy được trên laptop cá nhân, điện thoại hoặc phục vụ tác vụ đơn giản.

184 mô hình
Anthropic

Claude 4.5 Haiku

C

Mô hình AI Claude 4.5 Haiku được phát triển bởi Anthropic. Đạt điểm Intelligence Index 18/100 với tốc độ 89 tokens/s.

Độ thông minh
18.0
Tiếng Việt
90/100
Tốc độ89 tps
Giá đầu ra$0.25/1M
Anthropic

Claude 4.5 Haiku (Non-reasoning)

C

Mô hình AI Claude 4.5 Haiku (Non-reasoning) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 15/100 với tốc độ 91 tokens/s.

Độ thông minh
15.0
Tiếng Việt
90/100
Tốc độ91 tps
Giá đầu ra$0.60/1M
OpenAIMiễn phí

GPT-5.6 Luna (Non-reasoning)

C

Mô hình AI GPT-5.6 Luna (Non-reasoning) được phát triển bởi OpenAI. Đạt điểm Intelligence Index 16/100 với tốc độ 105 tokens/s.

Độ thông minh
16.0
Tiếng Việt
89/100
Tốc độ105 tps
Giá đầu ra$0.01/1M
OpenAIMởMiễn phí

gpt-oss-120b (high)

C

Mô hình AI gpt-oss-120b (high) được phát triển bởi OpenAI. Đạt điểm Intelligence Index 12/100 với tốc độ 178 tokens/s.

Độ thông minh
12.0
Tiếng Việt
89/100
Tốc độ178 tps
Giá đầu ra$0.13/1M
OpenAIMởMiễn phí

gpt-oss-120b (low)

C

Mô hình AI gpt-oss-120b (low) được phát triển bởi OpenAI. Đạt điểm Intelligence Index 10/100 với tốc độ 178 tokens/s.

Độ thông minh
10.0
Tiếng Việt
89/100
Tốc độ178 tps
Giá đầu ra$0.60/1M
OpenAIMởMiễn phí

gpt-oss-20b (low)

C

Mô hình AI gpt-oss-20b (low) được phát triển bởi OpenAI. Đạt điểm Intelligence Index 10/100 với tốc độ 253 tokens/s.

Độ thông minh
10.0
Tiếng Việt
89/100
Tốc độ253 tps
Giá đầu ra$0.60/1M
Trợ lý gợi ý thông minh

Trắc Nghiệm: Tìm Mô Hình AI Hoàn Hảo Cho Bạn

Trả lời 3 câu hỏi nhanh dưới 1 phút để nhận ngay lời khuyên chính xác

Dự toán ngân sách

Máy Tính Chi Phí Thực Tế Theo VNĐ & USD

Xem bạn sẽ tốn bao nhiêu tiền khi ứng dụng AI vào công việc thực tế

Số từ đưa vào mỗi tháng (Câu hỏi, tài liệu gửi cho AI):400.000 từ (~600k tokens)
Câu hỏi, yêu cầu, văn bản bạn gửi vào cho AI xử lý
Số từ AI trả lời mỗi tháng (Câu trả lời, bài viết sinh ra):600.000 từ (~900k tokens)
Bài viết, câu trả lời do AI sinh ra gửi về cho bạn
Mẹo tiết kiệm: Dùng DeepSeek V3 hoặc Gemini Flash có thể tiết kiệm tới 90% chi phí so với GPT-4o!Ghi chú: Hệ thống tự động quy đổi 1 từ tiếng Việt ≈ 1.6 token
Mô hình AIHạng (Tier)Chi phí thángThao tác
GPT-5.6 Luna (low)Rẻ vô địch
OpenAI
B-Tier
229 ₫
~$0.01
GPT-5.6 Luna (Non-reasoning)
OpenAI
C-Tier
229 ₫
~$0.01
gpt-oss-20b (high)
OpenAI
C-Tier
229 ₫
~$0.01
Granite 4.2 3B
IBM
C-Tier
229 ₫
~$0.01
GPT-5.6 Luna (medium)
OpenAI
B-Tier
611 ₫
~$0.02
MiMo-V2.5
Xiaomi
B-Tier
611 ₫
~$0.02
Nemotron 3 Nano
NVIDIA
C-Tier
611 ₫
~$0.02
Granite 4.2 8B
IBM
C-Tier
611 ₫
~$0.02
Ling 3.0 Flash
InclusionAI
B-Tier
1.069 ₫
~$0.04
GPT-5.6 Luna (high)
OpenAI
B-Tier
1.451 ₫
~$0.06
Đấu trường so găng

So Sánh Trực Quan 1-đối-1

Đặt 2 mô hình lên bàn cân để xem ai vượt trội hơn theo từng tiêu chí

Anthropic

Claude Fable 5.1 (max with fallback)

Mô hình AI Claude Fable 5.1 (max with fallback) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 53/100 với tốc độ 67 tokens/s.
VS
Anthropic

Claude Fable 5.1 (high with fallback)

Mô hình AI Claude Fable 5.1 (high with fallback) được phát triển bởi Anthropic. Đạt điểm Intelligence Index 51/100 với tốc độ 58 tokens/s.

So sánh 5 chỉ số trực diện

53/100 🏆 ThắngAi thông minh hơn? 51/100
98/100 🇻🇳 Ai nói tiếng Việt mượt hơn? 98/100
67 tps ⚡ Nhanh hơn Ai chạy nhanh hơn? 58 tps
233.122 ₫/1M Ai tiết kiệm tiền hơn?💰 Rẻ hơn 119.361 ₫/1M
99/100 Khả năng Lập Trình (Code) 99/100

Lời khuyên chốt hạ

👉 Khi nào nên chọn Claude Fable 5.1 (max with fallback)?
  • Tư duy giải toán, suy luận logic phức tạp và lập trình chuyên sâu
👉 Khi nào nên chọn Claude Fable 5.1 (high with fallback)?
  • Tư duy giải toán, suy luận logic phức tạp và lập trình chuyên sâu

Bảng Xếp Hạng Toàn Bộ 652 Mô Hình

652 models

Dữ liệu được đo lường độc lập và đồng bộ tự động mỗi 15 phút

Mô hình (652)
Điểm Thông Minh
Chi Phí (VND)
Tốc Độ (tps)
🇻🇳 Tiếng Việt
Chi tiết
1.
Claude Fable 5.1 (max with fallback)S
Anthropic1M
53194.184 ₫6798/100
2.
Claude Fable 5.1 (xhigh with fallback)S
Anthropic1M
53152.191 ₫5898/100
3.
GPT-6 Astra (max)S
OpenAI1M
5382.967 ₫5397/100
4.
GPT-6 Astra (xhigh)S
OpenAI1M
5358.790 ₫5397/100
5.
Claude Fable 5.1 (high with fallback)S
Anthropic1M
5199.510 ₫5898/100
6.
Claude Opus 5 (max)S
Anthropic1M
51149.137 ₫5298/100
7.
GPT-6 Astra (high)S
OpenAI1M
5143.774 ₫5297/100
8.
Claude Fable 5 (with fallback)S
Anthropic1M
50222.688 ₫6898/100
9.
Claude Opus 5 (xhigh)S
Anthropic1M
50124.196 ₫5498/100
10.
GPT-6 Astra (medium)S
OpenAI1M
5039.193 ₫5397/100
11.
Claude Fable 5.1 (medium with fallback)S
Anthropic1M
4975.841 ₫5298/100
12.
Claude Opus 5 (high)S
Anthropic1M
4891.875 ₫5298/100
13.
Muse Spark 1.3 (max)S
Meta1M
4840.720 ₫23890/100
14.
Claude Fable 5.1 (low with fallback)S
Anthropic1M
4760.317 ₫5498/100
15.
GPT-5.6 Sol (max)S
OpenAI1M
4750.646 ₫7397/100
16.
GPT-6 Astra (low)S
OpenAI1M
4620.869 ₫5197/100
17.
Claude Opus 5 (medium)S
Anthropic1M
4555.736 ₫5196/100
18.
Muse Spark 1.3 (xhigh)S
Meta1M
4534.867 ₫23588/100
19.
Qwen3.8 Max (0902)SOSS
Alibaba984k
45137.685 ₫4089/100
20.
GLM-5.3 (max)SOSS
Z AI1M
4551.154 ₫6780/100
21.
GPT-5.6 Sol (xhigh)A
OpenAI1M
4430.031 ₫6895/100
22.
Grok 4.6 (high)A
SpaceXAI500k
4447.337 ₫6586/100
23.
Grok 4.6 (xhigh)A
SpaceXAI500k
4459.044 ₫6086/100
24.
Kimi K3 (max)A
Kimi1.05M
4450.900 ₫3680/100
25.
Grok 4.6 (medium)A
SpaceXAI500k
4338.175 ₫5786/100
Hiển thị 25 trên tổng số 652 mô hình
1 / 27
Theo dõi hạ tầng thời gian thực

Radar Trực Tiếp: Tốc Độ & Độ Trễ Hạ Tầng AI

Theo dõi thời gian thực tốc độ xử lý (TPS) và độ trễ (Latency) của các nhà cung cấp

Cập nhật lúc: --:--:--
💡 Bí quyết bạn nên biết: Cùng một mô hình AI (như DeepSeek R1 hoặc Llama 3.3), tốc độ sinh chữ trên chip LPU của Groq hoặc Cerebras có thể nhanh gấp 5 - 7 lần so với máy chủ API gốc mà chi phí lại tương đương hoặc rẻ hơn!

Groq (LPU)

North America (Multi-region)
Hoạt động tốt
Tốc độ thực tế
310 tps
Độ trễ trung bình
140 ms
Uptime 30 ngày:99.95%
Mô hình phục vụ
DeepSeek R1DeepSeek V3Llama 3.3 70BLlama 3.1 8B

Cerebras Inference

US West
Hoạt động tốt
Tốc độ thực tế
450 tps
Độ trễ trung bình
110 ms
Uptime 30 ngày:99.88%
Mô hình phục vụ
Llama 3.3 70BLlama 3.1 8B

Anthropic Direct API

Global CDN / AWS
Hoạt động tốt
Tốc độ thực tế
75 tps
Độ trễ trung bình
420 ms
Uptime 30 ngày:99.92%
Mô hình phục vụ
Claude 3.7 SonnetClaude 3.5 SonnetClaude 3.5 Haiku

OpenAI Direct API

US East / Azure Global
Hoạt động tốt
Tốc độ thực tế
115 tps
Độ trễ trung bình
380 ms
Uptime 30 ngày:99.91%
Mô hình phục vụ
GPT-4oGPT-4o minio3-minio1

Google AI Studio / Vertex

Global Edge (incl. Singapore/Tokyo)
Hoạt động tốt
Tốc độ thực tế
195 tps
Độ trễ trung bình
260 ms
Uptime 30 ngày:99.98%
Mô hình phục vụ
Gemini 2.5 ProGemini 2.5 FlashGemma 2 9B

DeepSeek Official API

Asia Pacific
Đang chậm / Quá tải
Tốc độ thực tế
42 tps
Độ trễ trung bình
950 ms
Uptime 30 ngày:97.8%
Mô hình phục vụ
DeepSeek R1DeepSeek V3

Together AI

US & EU
Hoạt động tốt
Tốc độ thực tế
135 tps
Độ trễ trung bình
320 ms
Uptime 30 ngày:99.85%
Mô hình phục vụ
DeepSeek R1DeepSeek V3Qwen 2.5 Coder 32BLlama 3.3 70B

DeepInfra

North America / Europe
Hoạt động tốt
Tốc độ thực tế
145 tps
Độ trễ trung bình
290 ms
Uptime 30 ngày:99.89%
Mô hình phục vụ
DeepSeek R1DeepSeek V3Qwen 2.5 Coder 32BLlama 3.1 8B
Cẩm nang cho người không chuyên

Giải Thích Thuật Ngữ Bằng Tiếng Người Thường

Bỏ qua những từ ngữ học thuật khó hiểu — đây là những gì bạn thực sự cần biết

Token là gì?

Đơn vị đo lường cơ bản mà AI dùng để "đọc" và "viết"

Định nghĩa đơn giản:

AI không nhìn văn bản từng chữ cái như con người, mà chia nhỏ thành các mẩu ký tự gọi là "Token". Trung bình, 1 từ tiếng Anh là khoảng 1.3 token, còn với tiếng Việt có dấu, 1 từ thường tốn khoảng 1.5 - 2 token.

So sánh đời thực

📖 Hình dung thực tế: 1 triệu token tương đương khoảng 1.500 trang sách A4 đặc chữ! Một cuộc trò chuyện bình thường chỉ tốn vài trăm token.

Ý nghĩa thực tế

Biết số lượng token giúp bạn tính toán chính xác số tiền bỏ ra hàng tháng khi dùng AI, tránh bị bất ngờ vì hóa đơn.