66B hay 66 tỷ tham số là một loại mô hình ngôn ngữ được huấn luyện để sinh văn bản, trả lời câu hỏi và thực hiện các tác vụ xử lý ngôn ngữ tự nhiên ở mức độ cao.
Mô hình được xây dựng trên kiến trúc transformer, với nhiều lớp tự chú ý (self attention) và cơ chế tiền huấn luyện trên dữ liệu lớn. 66B có thể sinh văn bản mạch lạc, kéo dài và duy trì ngữ cảnh từ đầu đến cuối.
So với các mô hình có kích thước lớn hơn hoặc nhỏ hơn, 66B cân bằng giữa khả năng tổng quát và chi phí tính toán. Nó cho tốc độ suy diễn hợp lý và khối lượng tham chiếu có thể được điều chỉnh cho nhiều tác vụ.
Trong ứng dụng thực tế, 66B có thể được dùng cho trợ lý ảo, tóm tắt văn bản, dịch thuật và tạo nội dung. Tuy nhiên, thách thức bao gồm an toàn nội dung, sai lệch thông tin và tiêu thụ điện năng ở quy mô lớn.
66B đại diện cho một mức cân bằng trong thang đo mô hình ngôn ngữ, mang lại hiệu suất tốt cho nhiều tác vụ mà vẫn có thể triển khai trên hạ tầng vừa phải. Trong tương lai, nó có thể được kết hợp với tinh chỉnh đặc thù ngành và các kỹ thuật an toàn nội dung.
