66b là một mô hình ngôn ngữ có quy mô 66 tỷ tham số, được thiết kế để xử lý ngôn ngữ tự nhiên với khả năng hiểu và sinh văn bản ở nhiều ngữ cảnh. Nó nằm ở giữa các mô hình nhỏ và rất lớn, cân bằng giữa hiệu suất và chi phí tính toán.
66b dùng một kiến trúc transformer với nhiều lớp attention và feed-forward. Với khoảng 66 tỷ tham số, nó có khả năng nắm bắt mối quan hệ dài hạn và cú pháp phức tạp của ngôn ngữ, nhưng vẫn đòi hỏi tối ưu hóa để triển khai ở mức thực tế.
Đào tạo của 66b dựa trên tập dữ liệu lớn, đa ngành, gồm văn bản từ sách, bài báo, web và nguồn mở. Quá trình huấn luyện đi kèm với kỹ thuật giảm thiểu sai lệch và tối ưu hóa hiệu suất trên phần cứng có giới hạn.
66b có thể được dùng để trả lời câu hỏi, viết văn bản, tóm tắt, dịch ngữ và hỗ trợ sáng tạo. Tuy nhiên, nó cũng có hạn chế như tiềm ẩn thiên lệch, cần kiểm tra bảo mật và chi phí vận hành ở mức cao đối với nhiều tác vụ.
