66B là một mô hình ngôn ngữ quy mô lớn được huấn luyện để xử lý ngôn ngữ tự nhiên ở mức độ cao, với khoảng 66 tỷ tham số, tương đương quy mô lớn nhưng nhỏ hơn các mô hình 70B hoặc 100B, cho một cân bằng giữa hiệu năng và hiệu suất tính toán.
Mô hình sử dụng kiến trúc transformer kiểu tự chú ý, tập trung vào hiểu ngữ cảnh dài và trả lời câu hỏi một cách tự nhiên. Số tham số khoảng 66B cho phép mô hình lưu trữ nhiều mẫu ngôn ngữ và thông tin ngữ nghĩa đầy đủ.

66B được huấn luyện trên một tập dữ liệu đa dạng gồm văn bản từ web, sách và bản ghi công khai, với biên tập và lọc để giảm thông tin nhạy cảm và nâng cao chất lượng sinh ngữ.
Nhờ quy mô và khả năng sinh ngôn ngữ tự nhiên, 66B có thể dùng cho trợ lý ảo, tạo nội dung, phân tích cảm xúc và tóm tắt văn bản, cũng như tích hợp vào hệ thống chat và dịch thuật.

66B có thể sinh văn bản trôi chảy nhưng vẫn có thể tạo thông tin sai lệch hoặc không đầy đủ. Cần đánh giá và kiểm tra đầu ra, đặc biệt trong tác vụ nhạy cảm hoặc yêu cầu pháp lý.
