Bảng giá API và gói thành viên Kimi K2.6

8 phút đọc2026-08-12
Kimi K2.6 pricing

Kimi K2.6 là mô hình mã nguồn mở với năng lực hàng đầu về lập trình, thực thi dài hạn và agent swarm. Dưới đây là tổng quan về giá Kimi API và các gói thành viên Kimi.

Tổng quan giá Kimi K2.6 API

Giá Kimi K2.6 API áp dụng mô hình dựa trên token, tính phí theo mỗi 1M tokens (1.000.000 tokens) cho cả xử lý đầu vào và đầu ra, giúp kiểm soát chi phí rõ ràng và dễ dự đoán.

Mô hìnhĐơn vịGiá đầu vào (Cache Hit)Giá đầu vào (Cache Miss)Giá đầu raCửa sổ ngữ cảnh
kimi-k2.61M tokens$0.16$0.95$4.00262,144 tokens

Mô hình giá Kimi K2.6 API

Kimi K2.6 API dùng mô hình định giá dựa trên token cho từng yêu cầu; mỗi lần tương tác với mô hình đều tiêu thụ token và được tính phí theo loại token. Trong mô hình này, token thường được chia thành ba loại: token đầu vào, token đầu ra và token đầu vào được lưu trong cache.

token đầu vào

token đầu vào bao gồm mọi nội dung được gửi tới mô hình, chẳng hạn:

  • Prompt của người dùng

  • Chỉ dẫn hệ thống

  • Lịch sử hội thoại hoặc ngữ cảnh

Các token này quyết định lượng ngữ cảnh mà mô hình cần xử lý trước khi tạo phản hồi.

token đầu ra

token đầu ra do mô hình tạo ra để phản hồi một yêu cầu. Chúng thể hiện nội dung thực tế do AI tạo, chẳng hạn:

  • Phản hồi dạng văn bản

  • Sinh mã

  • Đầu ra có cấu trúc

Vì việc tạo đầu ra đòi hỏi thêm năng lực tính toán, giá của token đầu ra thường cao hơn token đầu vào.

token đầu vào được lưu trong cache

token đầu vào được lưu trong cache xuất hiện khi ngữ cảnh đã xử lý trước đó được tái sử dụng.

  • Nếu cùng một ngữ cảnh hoặc ngữ cảnh tương tự được dùng lại, chi phí có thể được giảm

  • Điều này cải thiện đáng kể hiệu quả cho các quy trình lặp lại

  • Đặc biệt hữu ích trong các ứng dụng ngữ cảnh dài hoặc tương tác nhiều lượt

Ghi chú về giá Kimi K2.6 API

Giá Kimi K2.6 API tuân theo mô hình minh bạch, tính theo mức sử dụng; dưới đây là một vài điểm quan trọng giúp nhà phát triển hiểu rõ hơn về cách tính phí và hành vi chi phí.

Chính sách thuế và thanh toán

Tất cả mức giá niêm yết cho Kimi K2.6 API chưa bao gồm các khoản thuế áp dụng. Thuế được tự động tính khi thanh toán dựa trên khu vực lập hóa đơn của người dùng và quy định thuế địa phương, bảo đảm mỗi đơn hàng được xuất hóa đơn chính xác và đúng quy định.

Giải thích về mức sử dụng token

Để giá Kimi K2.6 API dễ hiểu hơn, việc tính phí sử dụng một chuẩn token nhất quán:

  • 1M tokens = 1,000,000 tokens

  • token đầu vào bao gồm prompt và thông tin ngữ cảnh

  • token đầu ra là các phản hồi do mô hình tạo ra

Cấu trúc này giúp ước tính chi phí minh bạch và dễ dự đoán cho mọi yêu cầu Kimi API.

Tối ưu chi phí nhờ cache

Kimi K2.6 cũng có cơ chế cache giúp tối ưu chi phí sử dụng. Khi làm việc với các đầu vào lặp lại hoặc tương tự, token đầu vào được lưu trong cache sẽ được tính phí ở mức thấp hơn, qua đó giảm tổng mức tiêu thụ theo mô hình giá Kimi API.

  • token đầu vào được lưu trong cache được tính phí theo mức chiết khấu

  • Ngữ cảnh được tái sử dụng giúp giảm tổng lượng token tiêu thụ

  • Nâng cao hiệu quả cho các phiên dài và quy trình lặp lại

Nhờ vậy, giá Kimi K2.6 API tiết kiệm hơn cho các kịch bản triển khai thực tế thường xuyên tái sử dụng prompt hoặc ngữ cảnh.

Dù không có tầng miễn phí Kimi API cố định cho mục đích sản xuất, mô hình giá vẫn được thiết kế linh hoạt và dễ mở rộng, cho phép nhà phát triển kiểm soát chi phí theo lượng token tiêu thụ thực tế.

Gói giá và tầng sử dụng cho Kimi K2.6

Ngoài cách tính giá theo mức sử dụng API, Kimi còn cung cấp các gói thành viên theo tầng, mở rộng theo nhu cầu và giúp bạn dễ chọn cấp độ phù hợp với quy trình làm việc. Người dùng có thể chọn tầng phù hợp nhất dựa trên nhu cầu sử dụng hằng ngày và yêu cầu mở rộng. Để biết thông tin mới nhất về các gói, hãy xem trang thành viên chính thức.

Tính năngAdagioModeratoAllegrettoAllegroVivace
Thanh toán hằng năm (tính theo tháng hiệu dụng)$0 / tháng$15 / tháng$31 / tháng$79 / tháng$159 / tháng
Tác vụ đồng thời1 tác vụ2 tác vụ2 tác vụ4 tác vụ4 tác vụ
Hàng đợi ưu tiên Agent×Tốc độ 4×Tốc độ 4×Tốc độ 4×Tốc độ 4×
Agent Swarm×
Subagent đồng thời×2 subagent4 subagent8 subagent8 subagent
Kimi Claw××
Kimi Claw (Web, Android, PC)××
Trò chuyện nhóm với Claw××10 cuộc trò chuyện10 cuộc trò chuyện10 cuộc trò chuyện
Triển khai website kèm cơ sở dữ liệu×

Kết luận

Kimi K2.6 mang đến mức giá linh hoạt cho cả nhà phát triển lẫn người dùng hằng ngày. Cách tính phí API theo token giúp chi phí minh bạch, dễ dự đoán, đồng thời hỗ trợ cache để giảm chi phí trong các quy trình khối lượng lớn hoặc ngữ cảnh dài. Với những ai muốn quyền truy cập có cấu trúc rõ ràng, các gói thành viên theo tầng mở rộng từ miễn phí đến nhu cầu chuyên nghiệp, bao gồm năng lực agent, tác vụ đồng thời và các công cụ như Kimi Claw, Agent Swarm. Dù bạn tích hợp qua API hay muốn khám phá trọn bộ tính năng của Kimi, luôn có một gói phù hợp với quy trình làm việc và ngân sách của bạn.

Câu hỏi thường gặp

Giá Kimi K2.6 API được tính như thế nào?
Giá Kimi K2.6 API được tính theo lượng token sử dụng, gồm token đầu vào, token đầu ra và token đầu vào được lưu trong cache. Toàn bộ mức sử dụng được tính theo mỗi 1M tokens (1.000.000 tokens), giúp chi phí Kimi API dễ đo lường và dự đoán trên nhiều khối lượng công việc khác nhau.
Yếu tố nào ảnh hưởng nhiều nhất đến tổng chi phí API?
Các yếu tố chi phí chính là lượng token đầu ra, độ dài prompt và kích thước ngữ cảnh. Trong hầu hết trường hợp, phản hồi dài hơn và đầu vào lớn hơn sẽ làm tăng tổng mức sử dụng theo mô hình giá K2.6 API.
Kimi K2.6 API có rẻ hơn khi dùng token được lưu trong cache không?
Có. token đầu vào được lưu trong cache có mức giá thấp hơn vì ngữ cảnh đã xử lý trước đó có thể được tái sử dụng. Điều này giúp giá Kimi API hiệu quả hơn cho các yêu cầu lặp lại hoặc tương tự.
Kimi K2.6 hỗ trợ bao nhiêu token cho mỗi yêu cầu?
Mô hình hỗ trợ cửa sổ ngữ cảnh tối đa 256K tokens, cho phép xử lý tài liệu dài, hội thoại kéo dài và các tác vụ nhiều bước phức tạp trong một yêu cầu duy nhất.
Điều gì xảy ra nếu đầu vào của tôi vượt quá cửa sổ ngữ cảnh?
Kimi K2.6 hỗ trợ tối đa 256K tokens cho mỗi yêu cầu. Nếu đầu vào vượt giới hạn này, bạn cần chia nhỏ hoặc rút gọn trước khi xử lý qua Kimi API.
Kimi K2.6 có hỗ trợ mức sử dụng lớn hoặc quy mô doanh nghiệp không?
Có. Kimi K2.6 được thiết kế cho các khối lượng công việc có khả năng mở rộng, hỗ trợ cả ứng dụng nhẹ lẫn kịch bản doanh nghiệp thông lượng cao với mức giá dựa trên token dễ dự đoán.
Kimi K2.6 API có phí ẩn không?
Không. Mô hình giá Kimi API hoàn toàn minh bạch và chỉ dựa trên lượng token sử dụng. Không có phí nền tảng ẩn, dù thuế có thể áp dụng tùy theo khu vực của người dùng.
Có thể bạn cũng sẽ thích
Hướng dẫn LlamaIndex Agents: Xây dựng ứng dụng AI thông minh hơn
Hướng dẫn LlamaIndex Agents: Xây dựng ứng dụng AI thông minh hơn
2026-08-13
LangChain Deep Agents: Tính năng, Khả năng & Hướng dẫn thiết lập
LangChain Deep Agents: Tính năng, Khả năng & Hướng dẫn thiết lập
2026-08-14
Hướng dẫn n8n AI Agent: Xây dựng và tự động hóa workflow
Hướng dẫn n8n AI Agent: Xây dựng và tự động hóa workflow
2026-08-13
Cài đặt Claude Code: Hướng dẫn đầy đủ cho Windows & Mac
Cài đặt Claude Code: Hướng dẫn đầy đủ cho Windows & Mac
2026-08-12
Cách kết nối API bên ngoài với Roo Code
Cách kết nối API bên ngoài với Roo Code
2026-08-12