Tất cả các mô hình

GLM-5.1: Mô hình ngữ cảnh 1M token của Z.AI

Sản phẩm chủ lực của Z.AI. Cửa sổ ngữ cảnh lên đến 1M token. Mạnh mẽ cho các tác nhân toàn bộ cơ sở mã hoặc toàn bộ cơ sở kiến thức với giá thấp hơn nhiều so với Sonnet.

1M tokens · Text / Code · Prompt cache

Okou không còn chạy GLM-5.1. Trang này được giữ lại làm tài liệu tham khảo cho các thông số kỹ thuật, giá cả và điểm chuẩn của nó. Đối với cùng loại công việc, hãy sử dụng GPT 5.6 Luna.

Xem GPT 5.6 Luna

GLM-5.1 là chuyên gia ngữ cảnh dài trong dòng sản phẩm, với đầu vào lên đến 1M token. Hãy tìm đến nó khi lời nhắc thực sự rất lớn: toàn bộ kho lưu trữ cùng một lúc, vài trăm tài liệu trong một lần chạy nghiên cứu duy nhất. Các bảng xếp hạng độc lập luôn xếp nó vào hàng đầu các mô hình mã nguồn mở cho công việc ngữ cảnh dài.

Giá niêm yết của nhà cung cấp là 1.40 đô la / 4.40 đô la cho mỗi 1M token, thấp hơn một nửa so với Sonnet 4.6 ở cấp độ nhà cung cấp, và API tương thích với Anthropic nên các tác nhân kiểu Claude có thể được đưa vào mà không cần viết lại. Hãy tìm đến Sonnet hoặc Opus khi độ sâu lý luận tiếng Anh quan trọng hơn kích thước ngữ cảnh, và đến Kimi K2.7 Code khi độ trễ là yếu tố chi phối.

GLM-5.1 là gì?

Z.AI / Mô hình đa năng hàng đầu của Zhipu AI.

GLM-5.1 là sản phẩm chủ lực của dòng GLM của Zhipu AI, được phân phối qua Z.AI. Đây là một mô hình suy luận với khả năng tổng quát mạnh mẽ và cửa sổ ngữ cảnh lớn bất thường. Lên đến 1M token, lớn hơn vài lần so với các giá trị mặc định của Anthropic và Moonshot ở cùng cấp giá.

Điều gì đáng chú ý về GLM-5.1

Kiến trúc tiêu đề và các tính năng khả năng.

GLM-5.1 hiển thị cửa sổ ngữ cảnh lên đến 1M token (lớn nhất trong dòng Built-in) thông qua bề mặt API tương thích Anthropic, vì vậy các tác nhân kiểu Claude có thể được đưa vào mà không thay đổi. Upstream hỗ trợ bộ nhớ đệm nhắc tại api.z.ai.

Thông số kỹ thuật nhanh

Gia đìnhDòng GLM-5
Phương thứcVăn bản, mã
Ngôn ngữĐa ngôn ngữ
Cửa sổ ngữ cảnhLên đến 1 triệu token
Bộ nhớ đệm lời nhắcĐược hỗ trợ (tương thích Anthropic)

Điểm chuẩn GLM-5.1

Các đánh giá độc lập xếp GLM-5.1 vào nhóm các mô hình mã nguồn mở hàng đầu cho các tác vụ ngữ cảnh dài. Các con số thay đổi hàng tuần trên các bảng xếp hạng của bên thứ ba. Chúng tôi cố tình không ghim các tỷ lệ phần trăm chính xác ở đây.

Đấu trường mãbảng xếp hạng của bên thứ ba
Top 3 (trọng số mở)
Khả năng nhớ ngữ cảnh dàido nhà cung cấp báo cáo
Mạnh mẽ trên cửa sổ 1M-token

Giá GLM-5.1

Giá niêm yết của nhà cung cấp, trên 1 triệu token.

Đầu vào$1.40
Đầu ra$4.40
Đọc bộ nhớ cache$0.26
Ghi bộ nhớ cache$1.40

Cách GLM-5.1 hoạt động trong thực tế

Hành vi được quan sát từ các lần chạy tác nhân sản xuất.

Khả năng nhớ ngữ cảnh dài

Cửa sổ 1M-token của GLM-5.1 thực sự có thể sử dụng được. Nó duy trì sự mạch lạc tốt vượt qua giới hạn 200K mà dòng Anthropic bị giới hạn trên các mô hình 200K cũ hơn. Hữu ích cho các tác nhân toàn bộ kho lưu trữ hoặc toàn bộ kho tài liệu.

Lý luận

Lý luận tổng quát vững chắc. Dưới Sonnet 4.6 về định tuyến đa công cụ tiếng Anh khó nhất, nhưng khoảng cách nhỏ so với sự khác biệt về chi phí.

Các tác vụ tác nhân tốt nhất cho GLM-5.1

Việc tái cấu trúc toàn bộ kho lưu trữ phù hợp trong một lời nhắc

Thả một cơ sở mã cỡ trung bình 500K token vào một cuộc gọi GLM-5.1 duy nhất và yêu cầu đổi tên đa tệp, đánh giá kiến trúc hoặc kiểm tra bảo mật. Các mô hình có cửa sổ nhỏ hơn buộc bạn phải chia nhỏ kho lưu trữ và ghép nối các kết quả lại với nhau, đó là nơi lỗi phát sinh. GLM-5.1 giữ mọi tệp trong bộ nhớ làm việc và tham chiếu các đường dẫn chính xác trong đầu ra của nó.

Chạy nghiên cứu trên hàng trăm tài liệu

Wiki, RFC, hợp đồng, phiếu hỗ trợ năm ngoái — tải toàn bộ đống cùng một lúc và yêu cầu các mẫu xuyên tài liệu. Chi phí mỗi lần chạy vẫn có thể quản lý được nhờ giá nhà cung cấp thấp, điều này làm cho loại quy trình làm việc "đọc mọi thứ, tóm tắt một lần" này thực sự phải chăng trong sản xuất thay vì một dự án khoa học một lần.

Khi nào nên bỏ qua GLM-5.1

Bỏ qua GLM-5.1 trong các suy luận tiếng Anh khó nhất mà Sonnet 4.6 hoặc Opus 4.7 vẫn dẫn đầu, và trong các phản hồi trò chuyện quan trọng về độ trễ mà Kimi K2.7 Code nhanh hơn nhiều.

GLM-5.1 so với các mô hình khác

GLM-5.1 so với Mã Kimi K2.7

Cả hai đều là các tùy chọn ngữ cảnh dài với chi phí tín dụng tương tự (×0.4 so với ×0.3). Kimi có khả năng nhớ ngữ cảnh dài mạnh hơn trong đánh giá nội bộ của chúng tôi; GLM-5.1 thắng về kích thước ngữ cảnh thô (1M so với 256K). Chọn Kimi cho các bản ghi rất dài; chọn GLM-5.1 khi bạn cần nhồi toàn bộ cơ sở mã vào một lời nhắc.

GLM-5.1 so với Claude Sonnet 4.6

Sonnet 4.6 (×1) dẫn đầu về độ chính xác định tuyến công cụ và khả năng suy luận tiếng Anh. GLM-5.1 (×0.4) dẫn đầu về cửa sổ ngữ cảnh và là lựa chọn phù hợp khi chi phí hoặc kích thước ngữ cảnh chiếm ưu thế trong quyết định.

GLM-5.1 so với DeepSeek V4 Pro

DeepSeek V4 Pro (×0.1) rẻ hơn và đạt điểm chuẩn cao hơn trên Code Arena theo đánh giá của bên thứ ba. GLM-5.1 vẫn thắng về kích thước ngữ cảnh. Chọn DeepSeek cho công việc ngữ cảnh tiêu chuẩn nhạy cảm về chi phí; chọn GLM-5.1 khi kích thước ngữ cảnh là ràng buộc.

Điểm mấu chốt: bạn có nên sử dụng GLM-5.1 không?

Chọn GLM-5.1 khi kích thước ngữ cảnh là hạn chế. Đối với mọi thứ khác, DeepSeek V4 Pro rẻ hơn và Sonnet 4.6 định tuyến công cụ đáng tin cậy hơn.

Khả dụng của GLM-5.1 trên Okou

GLM-5.1 đã bị xóa khỏi danh sách Okou, vì vậy không thể chọn nó trong trò chuyện hoặc trong quy trình làm việc, và nó không khả dụng với khóa API của riêng bạn. GPT 5.6 Luna bao gồm cùng một cấp tiết kiệm chi phí.