StepFun Step 5 Preview: Mô hình AI 600 tỷ tham số lọt vào nhóm dẫn đầu về trí tuệ với chi phí tối ưu

Công nghệ19 tháng 9, 2026·4 phút đọc

StepFun vừa phát hành Step 5 Preview, mô hình lý luận 600 tỷ tham số đạt 44 điểm trên Chỉ số Trí tuệ của Artificial Analysis, nằm trong nhóm dẫn đầu về hiệu năng so với mức giá. Với cửa sổ ngữ cảnh 1 triệu token, giá chỉ 1 USD mỗi triệu token đầu vào và tốc độ gần 100 token/giây, mô hình này đang tạo áp lực đáng kể lên các ông lớn như OpenAI và Anthropic.

StepFun Step 5 Preview: Mô hình AI 600 tỷ tham số lọt vào nhóm dẫn đầu về trí tuệ với chi phí tối ưu

StepFun, hãng nghiên cứu trí tuệ nhân tạo Trung Quốc, vừa đưa mô hình Step 5 Preview lên bảng xếp hạng của Artificial Analysis và ngay lập tức ghi dấu ấn khi nằm trên đường biên Pareto — nghĩa là không có mô hình nào vừa thông minh hơn vừa rẻ hơn ở cùng phân khúc.

Thông số nổi bật của Step 5 Preview

Step 5 Preview là mô hình lý luận (reasoning) với 600 tỷ tham số, ra mắt ngày 18/9/2026 và hiện chỉ phân phối qua API độc quyền của StepFun. Đây không phải mô hình mã nguồn mở — trọng số hoàn toàn đóng.

Các chỉ số chính theo đánh giá của Artificial Analysis:

  • Chỉ số Trí tuệ: 44 điểm (trung vị cùng phân khúc là 25), xếp hạng 25/200
  • Tốc độ: 99,8 token/giây, cao hơn mức trung bình 65 token/giây
  • Giá: 1 USD mỗi triệu token đầu vào, 2,70 USD mỗi triệu token đầu ra
  • Giảm giá cache lên tới 95%, còn 0,71 USD
  • Cửa sổ ngữ cảnh 1 triệu token, tương đương khoảng 1.500 trang A4 cỡ chữ 12
  • Độ dài phản hồi: rất cao, tiêu tốn 160 triệu token khi chạy trọn bộ bài kiểm tra (trung vị chỉ 90 triệu)

Vì sao mức giá này đáng chú ý?

Điểm gây ấn tượng nhất nằm ở tương quan giữa giá và hiệu năng. Trong khi trung vị giá token đầu ra của các mô hình lý luận cùng phân khúc lên tới 10 USD mỗi triệu token, Step 5 Preview chỉ thu 2,70 USD — rẻ hơn gần bốn lần.

Tổng chi phí để chạy toàn bộ Chỉ số Trí tuệ trên Step 5 Preview là 918,34 USD, trong khi nhiều mô hình hàng đầu khác tiêu tốn gấp nhiều lần con số này.

Với tỷ lệ pha trộn 7:2:1 giữa cache hit, đầu vào và đầu ra, giá hiệu dụng chỉ còn 0,51 USD mỗi triệu token. Đây là mức cạnh tranh trực tiếp với các dòng mô hình giá rẻ của DeepSeek và Alibaba.

Điểm mạnh và điểm yếu cần cân nhắc

Ưu điểm:

  • Trí tuệ vượt trội so với mức giá, nằm trên đường biên Pareto của Artificial Analysis
  • Hỗ trợ đầu vào văn bản và hình ảnh, đầu ra văn bản — tức là mô hình đa phương thức
  • Độ trễ token đầu tiên (TTFT) chỉ 2,96 giây, tốt hơn mức trung bình 3,61 giây
  • Cửa sổ ngữ cảnh 1 triệu token rất phù hợp cho các quy trình RAG xử lý khối dữ liệu lớn

Hạn chế:

  • Cực kỳ dài dòng: 160 triệu token sinh ra khi đánh giá, cao gần gấp đôi trung vị. Điều này đội chi phí thực tế lên đáng kể trong các ứng dụng sản xuất
  • Chỉ có một nhà cung cấp API duy nhất, thiếu phương án dự phòng khi gặp sự cố
  • Không mã nguồn mở, doanh nghiệp khó triển khai nội bộ vì lý do bảo mật dữ liệu

Bộ bài kiểm tra đánh giá

Chỉ số Trí tuệ phiên bản 4.3 của Artificial Analysis gồm 10 bài đánh giá độc lập:

  • AA-Briefcase — công việc tri thức dạng tác tử
  • GDPval-AA v2 — tác vụ công việc thực tế
  • AutomationBench-AA — quy trình SaaS tự động hóa
  • Terminal-Bench 4.0 — lập trình và sử dụng terminal
  • SciCode — viết mã khoa học
  • Humanity's Last Exam — lý luận và kiến thức chuyên sâu
  • AA-Omniscience — độ chính xác kiến thức và tỷ lệ ảo giác
  • AA-LCR v1.1 — lý luận ngữ cảnh dài

Ngoài ra Step 5 Preview còn được đo trên các chỉ số chuyên ngành như Harvey LAB-AA (pháp lý), ITBench-AA (xử lý sự cố Kubernetes) và 𝜏³-Banking (sử dụng công cụ tác tử trong ngân hàng).

Góc nhìn cho người dùng Việt Nam

Đối với các đội phát triển tại Việt Nam, Step 5 Preview mở ra một lựa chọn đáng cân nhắc trong bối cảnh chi phí API là yếu tố then chốt với các startup có ngân sách hạn chế.

Tuy nhiên, cần lưu ý hai điểm:

  1. Tính dài dòng khiến chi phí đầu ra thực tế có thể cao hơn nhiều so với con số niêm yết, đặc biệt với các tác vụ cần phản hồi ngắn gọn
  2. Rủi ro phụ thuộc nhà cung cấp đơn lẻ — nên có phương án dự phòng bằng các mô hình khác cho các tác vụ quan trọng

Việc một mô hình Trung Quốc liên tục chen chân vào nhóm dẫn đầu về hiệu năng trên mỗi đô la chi ra rằng cuộc đua tối ưu chi phí AI đang nóng lên, và người hưởng lợi cuối cùng chính là các nhà phát triển ứng dụng.

Chia sẻ:FacebookX
Nội dung tổng hợp bằng AI, mang tính tham khảo. Xem bài gốc ↗