66B là thuật ngữ dùng để chỉ một mô hình ngôn ngữ có kích thước khoảng 66 tỷ tham số. Các mô hình như vậy nằm trong làn sóng AI ngôn ngữ lớn được huấn luyện trên dữ liệu văn bản từ nhiều nguồn, nhằm cải thiện khả năng hiểu và sinh ngữ. Với quy mô tham số lớn, 66B đòi hỏi hạ tầng tính toán mạnh mẽ và kỹ thuật tối ưu hóa đặc thù.

66B dựa trên kiến trúc transformer, có nhiều lớp tự trọng, attention heads và feed-forward networks. Mô hình này có thể được huấn luyện bằng các công cụ phân tán và tối ưu hóa bằng kỹ thuật như mix-precision, gradient checkpointing, và pipeline parallelism. Hiệu suất ngôn ngữ tăng lên khi tăng tham số, tuy nhiên dần sẽ gặp thách thức như độ lệch dữ liệu, độ tin cậy và thời gian inference.
Mô hình 66B có thể được dùng cho tổng hợp văn bản, trả lời câu hỏi, hỗ trợ viết, phân tích ngữ nghĩa, dịch máy, và trợ lý ảo. Ở mức độ doanh nghiệp, mô hình có thể tùy biến cho các ngữ cảnh chuyên môn như pháp lý, y tế hay kỹ thuật, đồng thời cần quản trị rủi ro và đảm bảo an toàn phù hợp.
