66B là một mô hình ngôn ngữ dựa trên kiến trúc transformer, có quy mô lớn lên tới 66 tỷ tham số. Nó được thiết kế để hiểu và sinh ngôn ngữ tự nhiên ở nhiều ngữ cảnh khác nhau, từ viết báo cáo đến lập trình và trò chuyện tương tác.
Kiến trúc transformer cho 66B tận dụng nhiều tầng tự chú ý và mạng feed-forward sâu. Số tham số lớn cho phép mô hình nắm bắt ngữ nghĩa phức tạp, đồng thời tạo ra văn bản mạch lạc, logic. Tuy nhiên, kích thước lớn đòi hỏi hạ tầng phần cứng và chiến lược tối ưu hoá để giảm chi phí huấn luyện và suy luận.
Quá trình huấn luyện kết hợp nhiều nguồn dữ liệu trên internet, sách, và tài liệu kỹ thuật, với các biện pháp lọc và cân nhắc đạo đức nhằm giảm rủi ro từ dữ liệu nhiễu hoặc thiên vị. Việc huấn luyện trên phần cứng hiện đại kết hợp nhiều máy GPU/TPU và tối ưu phân phối tải giúp 66B học được các mẫu ngôn ngữ đa ngữ và đa thể loại.
66B có thể hỗ trợ viết nội dung, tóm tắt văn bản, trả lời câu hỏi, hỗ trợ lập trình, và làm trợ lý giáo dục. Mô hình có thể được tùy chỉnh cho các lĩnh vực cụ thể, cải thiện chất lượng phản hồi và khả năng tương tác với người dùng, đồng thời đặt ra thách thức về an toàn và bảo mật dữ liệu.
