66B là một mô hình ngôn ngữ có quy mô lớn với khoảng 66 tỷ tham số, được thiết kế để xử lý ngôn ngữ tự nhiên, sinh văn bản và hỗ trợ nhiều tác vụ AI.
66B sử dụng biến thể transformer với kiến trúc attention-based, có nhiều lớp decoder hoặc encoder-decoder tùy biến, tối ưu cho hiệu suất và hiệu quả tính toán.
66B được huấn luyện trên tập dữ liệu đa dạng gồm văn bản từ web, sách và nội dung do người dùng cung cấp, với chiến lược lọc và tinh chỉnh để giảm noise và bias.
66B có thể hỗ trợ tóm tắt, trả lời câu hỏi, dịch thuật và sáng tác nội dung. Tuy nhiên cũng đối mặt với thách thức về an toàn, sai lệch thông tin và tính minh bạch của kết quả.
