66B là một mô hình ngôn ngữ lớn được thiết kế để xử lý ngôn ngữ tự nhiên ở mức độ cao. Với 66 tỷ tham số, nó có khả năng sinh văn bản chất lượng, trả lời câu hỏi, hỗ trợ viết và tham gia vào nhiều tác vụ ngôn ngữ khác nhau.
66B dựa trên kiến trúc transformer, sử dụng nhiều lớp tự attention và mạng feed-forward. Việc huấn luyện diễn ra trên khối lượng dữ liệu lớn từ sách, bài báo và nội dung web có sự giám sát và lọc dữ liệu. Việc tối ưu hóa dành cho tham số lớn đòi hỏi hạ tầng phần cứng mạnh và kỹ thuật phân phối. Kết quả là khả năng hiểu ngôn ngữ và sinh văn bản tự nhiên, song vẫn đối mặt với rủi ro sai lệch thông tin nếu không được giám sát đúng cách.
66B có thể được dùng cho trợ lý ảo, viết sáng tạo, hỗ trợ lập trình và phân tích dữ liệu. Tuy nhiên, các thách thức bao gồm chi phí vận hành cao, khả năng tạo thông tin sai lệch, khuôn mẫu lệch và vấn đề an toàn. Để khai thác hiệu quả, cần quy trình đánh giá, giám sát đầu ra và giới hạn sử dụng phù hợp với từng ngữ cảnh.
