66B là một mô hình ngôn ngữ lớn có khoảng 66 tỷ tham số, được thiết kế nhằm xử lý ngôn ngữ tự nhiên ở cấp độ cao với khả năng suy luận, tóm tắt và hỗ trợ viết nội dung chuyên sâu.
Mô hình dựa trên kiến trúc Transformer, với nhiều lớp tự attention và feed-forward, tối ưu hóa quy mô tham số và dữ liệu đa ngôn ngữ để đạt hiệu suất cao trên các tác vụ ngôn ngữ tự nhiên và ngôn ngữ ít phổ biến.
Quá trình đào tạo kết hợp nguồn dữ liệu văn bản phong phú từ sách, bài viết và dữ liệu web, nhằm tăng tính đa dạng, khả năng khái quát và giảm thiên lệch trong hiệu suất mô hình.
66B có thể được áp dụng trong hỗ trợ viết, phân tích cảm xúc, dịch ngôn ngữ và phân tích dữ liệu, đồng thời đối mặt với thách thức về tài nguyên tính toán, đạo đức và an toàn khi triển khai rộng rãi.
