Bước tới nội dung

Mô hình ngôn ngữ lớn

Bách khoa toàn thư mở Wikipedia

Một mô hình ngôn ngữ lớn (LLM) là một mô hình ngôn ngữ với khả năng tổng quát trong việc tạo ngôn ngữ và các tác vụ xử lý ngôn ngữ tự nhiên khác. LLM có được khả năng này bằng cách học các mối quan hệ thống kê từ các văn bản trong quá trình huấn luyện tự giám sátbán giám sát có độ phức tạp tính toán cao.[1] LLM có thể được sử dụng cho việc tạo văn bản, một dạng trí tuệ nhân tạo tạo sinh, bằng cách nhận đầu vào văn bản và liên tục dự đoán token hoặc từ tiếp theo.[2]

LLM là các mạng nơ-ron nhân tạo. Các mô hình lớn nhất và mạnh mẽ nhất cho đến nay được xây dựng dựa trên một kiến trúc Transformer chỉ một chiều giải mã trong khi một số cài đặt gần đây dựa trên các kiến trúc khác, chẳng hạn như các biến thể của mạng nơ-ron hồi quyMamba (một mô hình trạng thái không gian).[3][4][5]

Đến năm 2020, việc tinh chỉnh là cách duy nhất mà một mô hình có thể được điều chỉnh để có thể hoàn thành các tác vụ cụ thể. Tuy nhiên, các mô hình kích thước lớn hơn, chẳng hạn như GPT-3, có thể thông qua kỹ thuật lời nhắc để đạt được kết quả tương tự.[6] Người ta cho rằng chúng có được kiến thức về cú pháp, ngữ nghĩa và các khái niệm trong các tập ngữ liệu của con người, nhưng cũng gặp phải những sai sót và thiên vị có trong các tập ngữ liệu đó.[7]

Một số LLM nổi bật bao gồm GPT của OpenAI (chẳng hạn như GPT-3.5GPT-4, được sử dụng trong ChatGPTMicrosoft Copilot), PaLM của GoogleGemini (Gemini hiện được sử dụng trong chatbot cùng tên), Grok của xAI, LLaMA của Meta, các mô hình Claude của Anthropic và các mô hình nguồn mở của Mistral AI.

Lịch sử

[sửa | sửa mã nguồn]
Số lượng ấn phẩm về mô hình ngôn ngữ lớn theo năm được phân nhóm theo loại ấn phẩm
Khả năng tính toán huấn luyện của các mô hình lớn đáng chú ý được tính bằng FLOPs so với ngày công bố trong giai đoạn 2010–2024. Đối với tổng thể các mô hình đáng chú ý (trên cùng bên trái), mô hình tiên phong (trên cùng bên phải), các mô hình ngôn ngữ hàng đầu (dưới cùng bên trái) và các mô hình hàng đầu trong các công ty dẫn đầu (dưới cùng bên phải). Phần lớn các mô hình này là mô hình ngôn ngữ.
Năng lực tính toán huấn luyện của các mô hình AI lớn đáng chú ý tính bằng FLOPs so với ngày xuất bản trong giai đoạn 2017–2024. Phần lớn các mô hình lớn là mô hình ngôn ngữ hoặc mô hình đa phương thức với khả năng ngôn ngữ.

Trước sự xuất hiện của các mô hình dựa trên transformer vào năm 2017, một số mô hình ngôn ngữ được coi là lớn so với các hạn chế về tính toán và dữ liệu trong thời đại của chúng. Đầu những năm 1990, các mô hình thống kê của IBM đã đi tiên phong trong các kỹ thuật căn chỉnh từ cho dịch máy, đặt nền móng cho lập mô hình ngôn ngữ dựa trên kho ngữ liệu. Vào năm 2001, một mô hình n-gram được làm mịn, chẳng hạn như những mô hình sử dụng kỹ thuật làm mịn Kneser–Ney, được huấn luyện trên 300 triệu từ, đã đạt được mức độ phức tạp (perplexity) tối ưu trên các bài kiểm tra chuẩn.[8] Trong những năm 2000, với sự phát triển của internet phổ cập, các nhà nghiên cứu bắt đầu biên soạn các bộ dữ liệu văn bản khổng lồ từ web ("web như một kho ngữ liệu"[9]) để huấn luyện các mô hình ngôn ngữ thống kê.[10][11]

Vượt ra ngoài các mô hình n-gram, bắt đầu từ năm 2000, các nhà nghiên cứu đã sử dụng mạng nơ-ron để học các mô hình ngôn ngữ.[12] Theo sau sự đột phá của mạng nơ-ron sâu (deep learning) trong phân loại hình ảnh vào khoảng năm 2012,[13] các kiến trúc tương tự đã được điều chỉnh cho các tác vụ ngôn ngữ. Sự thay đổi này được đánh dấu bằng sự phát triển của nhúng từ (word embeddings) (ví dụ: Word2Vec của Mikolov vào năm 2013) và các mô hình chuỗi-đến-chuỗi (seq2seq) sử dụng LSTM. Vào năm 2016, Google đã chuyển đổi dịch vụ dịch thuật của mình sang dịch máy nơ-ron (NMT), thay thế các mô hình dựa trên cụm từ thống kê bằng các mạng nơ-ron hồi quy sâu. Các hệ thống NMT ban đầu này đã sử dụng kiến trúc bộ mã hóa-giải mã (encoder-decoder) dựa trên LSTM, vì chúng xuất hiện trước khi transformer được phát minh.

Hình minh họa các thành phần chính của mô hình transformer từ bài báo gốc, nơi các lớp được chuẩn hóa sau (thay vì trước) sự chú ý đa đầu (multiheaded attention)

Tại hội nghị NeurIPS năm 2017, các nhà nghiên cứu của Google đã giới thiệu kiến trúc transformer trong bài báo mang tính bước ngoặt "Attention Is All You Need".[14] Mục tiêu của bài báo này là cải thiện công nghệ seq2seq năm 2014,[15] và chủ yếu dựa trên cơ chế chú ý được phát triển bởi Bahdanau và cộng sự vào năm 2014.[16] Năm tiếp theo, 2018, BERT đã được giới thiệu và nhanh chóng trở nên "phổ biến".[17] Mặc dù transformer ban đầu có cả khối bộ mã hóa (encoder) và bộ giải mã (decoder), BERT là một mô hình chỉ có bộ mã hóa. Việc sử dụng BERT trong học thuật và nghiên cứu bắt đầu giảm vào năm 2023, sau những cải tiến nhanh chóng về khả năng của các mô hình chỉ có bộ giải mã (chẳng hạn như GPT) để giải quyết các tác vụ thông qua nhắc nhở (prompting).[18]

Mặc dù mô hình chỉ có bộ giải mã GPT-1 được giới thiệu vào năm 2018, nhưng chính GPT-2 vào năm 2019 mới thu hút sự chú ý rộng rãi bởi vì OpenAI tuyên bố rằng ban đầu họ cho rằng nó quá mạnh để phát hành ra công chúng vì sợ sử dụng vào mục đích xấu.[19] GPT-3 vào năm 2020 đã tiến thêm một bước nữa và tính đến năm 2025 chỉ khả dụng qua API mà không có bản cài đặt cục bộ nào. Tuy nhiên, chính chatbot hướng đến người tiêu dùng vào năm 2022 là ChatGPT đã nhận được sự đưa tin rộng rãi của các phương tiện truyền thông và sự chú ý của công chúng.[20] GPT-4 của năm 2023 được ca ngợi vì độ chính xác được nâng cao và được xem như "chén thánh" nhờ các khả năng đa phương thức của nó.[21] OpenAI không tiết lộ kiến trúc cấp cao và số lượng tham số của GPT-4. Việc phát hành ChatGPT đã dẫn đến sự gia tăng trong việc sử dụng LLM ở nhiều lĩnh vực nghiên cứu nhỏ của khoa học máy tính, bao gồm robot học, kỹ nghệ phần mềm và các tác động xã hội.[18] Năm 2024, OpenAI phát hành mô hình suy luận OpenAI o1, có khả năng tự tạo ra chuỗi suy nghĩ dài trước khi trả lời câu hỏi.[22] Nhiều LLM với số lượng tham số tương đương với các dòng GPT của OpenAI đã được phát triển.[23]

Kể từ năm 2022, các mô hình với trọng số mở (open-weight models) ngày càng trở nên phổ biến, nổi bật ban đầu với BLOOMLLaMA, mặc dù cả hai đều có những hạn chế về việc sử dụng và triển khai. Các mô hình Mistral 7B và Mixtral 8x7b của Mistral AIGiấy phép Apache thoáng hơn. Vào tháng 1 năm 2025, DeepSeek đã phát hành DeepSeek R1, một mô hình mã nguồn mở 671 tỷ tham số có hiệu suất tương đương OpenAI o1 nhưng với chi phí cho mỗi token thấp hơn rất nhiều đối với người dùng.[24]

Kể từ năm 2023, nhiều LLM đã được đào tạo để trở thành đa phương thức, có khả năng xử lý hoặc tạo ra các loại dữ liệu khác, chẳng hạn như hình ảnh, âm thanh hoặc lưới 3D.[25] Các LLM này còn được gọi là các mô hình đa phương thức lớn (LMMs),[26] hoặc mô hình ngôn ngữ lớn đa phương thức (MLLMs).[27][28]

Tính đến năm 2024, các mô hình lớn nhất và có khả năng nhất đều dựa trên kiến trúc transformer. Một số triển khai gần đây dựa trên các kiến trúc khác, chẳng hạn như các biến thể mạng nơ-ron hồi quyMamba (một mô hình không gian trạng thái).[29][30][31]

Kể từ năm 2023, các mô hình ngôn ngữ lớn nguồn mở (open-weight LLMs) ngày càng định hình rõ nét lĩnh vực này, góp phần mở rộng sự tham gia vào việc phát triển AI và tăng tính minh bạch trong quá trình đánh giá mô hình. Theo Vake và cộng sự (2025), những đóng góp từ cộng đồng đối với các mô hình nguồn mở đã cải thiện rõ rệt hiệu năng và hiệu quả, cùng sự tăng trưởng mạnh mẽ của lượng người tham gia trên các nền tảng cộng tác như Hugging Face.[32] Paris và cộng sự (2025) cho rằng sự cởi mở trong AI không chỉ nên dừng lại ở việc công bố mã nguồn hay các bộ dữ liệu mô hình mà còn cần phải bao trùm cả tính toàn diện, tính trách nhiệm giải trình cũng như đạo đức trong việc triển khai và nghiên cứu AI.[33] Nhìn chung, những nghiên cứu này chỉ ra rằng các mô hình ngôn ngữ mã nguồn mở sẽ đẩy nhanh quá trình cải tiến đổi mới và tăng cường tính nhất quán trong khoa học, đồng thời nuôi dưỡng một hệ sinh thái AI minh bạch và thu hút sự chung tay tham gia.

Tiền xử lý dữ liệu

[sửa | sửa mã nguồn]

Token hóa (Tokenization)

[sửa | sửa mã nguồn]

Vì các thuật toán học máy xử lý các con số thay vì văn bản, văn bản phải được chuyển đổi thành số. Trong bước đầu tiên, một từ vựng được quyết định, sau đó các chỉ số số nguyên được gán một cách ngẫu nhiên nhưng duy nhất cho từng mục từ vựng, và cuối cùng, một nhúng (embedding) được liên kết với chỉ số số nguyên. Các thuật toán bao gồm mã hóa cặp byte (BPE) và WordPiece. Ngoài ra còn có các token đặc biệt đóng vai trò là ký tự điều khiển, chẳng hạn như [MASK] cho các token bị che (như được sử dụng trong BERT) và [UNK] ("không xác định") cho các ký tự không xuất hiện trong từ vựng. Ngoài ra, một số ký hiệu đặc biệt được sử dụng để biểu thị định dạng văn bản đặc biệt. Ví dụ, "Ġ" biểu thị một khoảng trắng đứng trước trong RoBERTa và GPT và "##" biểu thị sự tiếp nối của một từ đứng trước trong BERT.[34]

Ví dụ, bộ mã hóa token BPE được sử dụng bởi phiên bản kế thừa của GPT-3 sẽ phân tách tokenizer: texts -> series of numerical "tokens" như sau:

token  izer  :  texts  -> series   of  numerical    t ok ens

Token hóa cũng nén các tập dữ liệu. Bởi vì LLM thường yêu cầu đầu vào là một mảng không phải là mảng rách (jagged array), nên các văn bản ngắn hơn phải được "lấp đầy" (padded) cho đến khi khớp với chiều dài của văn bản dài nhất. Số từ trung bình trên mỗi token phụ thuộc vào ngôn ngữ.[35][36]

Mã hóa cặp byte (Byte-pair encoding)

[sửa | sửa mã nguồn]

Ví dụ, hãy xem xét một bộ mã hóa token dựa trên mã hóa cặp byte. Trong bước đầu tiên, tất cả các ký tự duy nhất (bao gồm cả khoảng trắng và dấu câu) được coi là tập hợp ban đầu của n-gram (tức là tập hợp ban đầu của uni-gram). Kế tiếp, cặp ký tự liền kề xuất hiện thường xuyên nhất được hợp nhất thành một bi-gram và tất cả các phiên bản của cặp đó được thay thế bằng nó. Tất cả các lần xuất hiện của các cặp liền kề của các n-gram (đã hợp nhất trước đó) thường xuất hiện cùng nhau nhất sau đó lại được hợp nhất thành các n-gram dài hơn, cho đến khi thu được một bộ từ vựng có kích thước theo quy định. Sau khi một trình tạo token được huấn luyện, bất kỳ văn bản nào cũng có thể được token hóa bởi nó, miễn là văn bản đó không chứa các ký tự không xuất hiện trong bộ uni-gram ban đầu.[37]

Vấn đề

[sửa | sửa mã nguồn]

Một bộ từ vựng token dựa trên tần suất được trích xuất từ các kho ngữ liệu chủ yếu là tiếng Anh sử dụng càng ít token càng tốt cho một từ tiếng Anh trung bình. Tuy nhiên, một từ trung bình trong ngôn ngữ khác được mã hóa bởi bộ mã hóa được tối ưu hóa cho tiếng Anh như vậy sẽ bị chia thành một lượng token dưới mức tối ưu. Trình tạo token GPT-2 có thể sử dụng số lượng token gấp 15 lần cho mỗi từ đối với một số ngôn ngữ, chẳng hạn như cho tiếng ShanMyanmar. Thậm chí các ngôn ngữ phổ biến hơn như tiếng Bồ Đào Nhatiếng Đức còn có "khoản phụ thu 50%" so với tiếng Anh.[36]

Làm sạch bộ dữ liệu (Dataset cleaning)

[sửa | sửa mã nguồn]

Trong bối cảnh đào tạo LLM, các bộ dữ liệu thường được dọn dẹp bằng cách loại bỏ dữ liệu chất lượng thấp, trùng lặp hoặc độc hại.[38] Các bộ dữ liệu đã được làm sạch có thể tăng hiệu quả huấn luyện và dẫn đến cải thiện hiệu suất của các tác vụ tiếp theo (downstream).[39][40] Một LLM đã được huấn luyện có thể được sử dụng để dọn dẹp tập dữ liệu cho việc đào tạo một LLM khác.[41]

Với tỷ lệ nội dung do LLM tạo ra trên web ngày càng tăng, việc dọn dẹp dữ liệu trong tương lai có thể bao gồm việc lọc ra những nội dung như vậy. Nội dung do LLM tạo ra có thể gây ra vấn đề nếu nội dung đó tương tự như văn bản của con người (khiến việc lọc trở nên khó khăn) nhưng chất lượng thấp hơn (làm giảm hiệu suất của các mô hình được huấn luyện trên đó).[42]

Dữ liệu tổng hợp (Synthetic data)

[sửa | sửa mã nguồn]

Việc đào tạo các mô hình ngôn ngữ lớn nhất có thể cần nhiều dữ liệu ngôn ngữ hơn dữ liệu tự nhiên hiện có hoặc dữ liệu tự nhiên xuất hiện có chất lượng không đủ. Trong những trường hợp này, dữ liệu tổng hợp có thể được sử dụng. Dòng LLM Phi của Microsoft được đào tạo trên dữ liệu dạng sách giáo khoa do LLM khác tạo ra.[43]

Huấn luyện

[sửa | sửa mã nguồn]

Một LLM là một loại mô hình nền tảng được đào tạo trên ngôn ngữ. LLM có thể được đào tạo theo nhiều cách khác nhau. Cụ thể, các mô hình GPT đầu tiên được huấn luyện trước để dự đoán từ tiếp theo trên một lượng lớn dữ liệu, trước khi được tinh chỉnh.[44]

Cần có cơ sở hạ tầng đáng kể để đào tạo các mô hình lớn nhất. Xu hướng hướng tới các mô hình lớn hơn có thể thấy rõ trong danh sách các mô hình ngôn ngữ lớn. Ví dụ: quá trình huấn luyện GPT-2 (tức là mô hình 1,5 tỷ tham số) vào năm 2019 có giá 50.000 đô la, trong khi quá trình huấn luyện PaLM (mô hình 540 tỷ tham số) vào năm 2022 có giá 8 triệu đô la và Megatron-Turing NLG 530B (vào năm 2021) có giá khoảng 11 triệu đô la. Tính từ "lớn" trong "mô hình ngôn ngữ lớn" thực chất rất mơ hồ vì không có ngưỡng cố định nào về số lượng tham số cần thiết để đủ điều kiện là "lớn". GPT-1 năm 2018 có 117 triệu tham số.[cần dẫn nguồn]

Tinh chỉnh (Fine-tuning)

[sửa | sửa mã nguồn]

Trước khi được tinh chỉnh, hầu hết các LLM đều là bộ dự đoán token tiếp theo. Quá trình tinh chỉnh định hình hành vi của LLM thông qua các kỹ thuật như học tăng cường từ phản hồi của con người (RLHF)[45] hoặc AI hiến pháp.[46]

Tinh chỉnh chỉ thị (Instruction fine-tuning) là một hình thức học có giám sát được sử dụng để hướng dẫn LLM tuân theo các chỉ dẫn của người dùng. Vào năm 2022, OpenAI đã trình diễn InstructGPT, một phiên bản của GPT-3 cũng được tinh chỉnh tương tự để tuân theo các hướng dẫn.[47] 

Học tăng cường từ phản hồi của con người (RLHF) bao gồm việc đào tạo một mô hình phần thưởng để dự đoán văn bản nào con người thích hơn. Sau đó, LLM có thể được tinh chỉnh thông qua học tăng cường để đáp ứng tốt hơn mô hình phần thưởng này. Vì con người thường thích các câu trả lời trung thực, hữu ích và vô hại, nên RLHF ủng hộ các câu trả lời như vậy.[48]

Kiến trúc

[sửa | sửa mã nguồn]

Các mô hình ngôn ngữ lớn (LLM) thường dựa trên kiến trúc transformer, sử dụng cơ chế chú ý cho phép mô hình xử lý đồng thời các mối quan hệ giữa các thành phần trong một chuỗi, bất kể khoảng cách giữa chúng.

Cơ chế chú ý và cửa sổ ngữ cảnh

[sửa | sửa mã nguồn]
Minh họa cơ chế nhiều đầu chú ý trong transformer.[49]

Để xác định các token liên quan trong phạm vi cửa sổ ngữ cảnh, cơ chế chú ý tính toán các trọng số cho từng token dựa trên biểu diễn nhúng của chúng. Trong kiến trúc transformer, quá trình này thường được thực hiện thông qua nhiều đầu chú ý (attention heads), trong đó mỗi đầu có thể học các dạng quan hệ khác nhau giữa các token.[49]

Ví dụ, mô hình GPT-2 phiên bản nhỏ có khoảng 117 triệu tham số, sử dụng 12 đầu chú ý và cửa sổ ngữ cảnh khoảng 1024 token.[50]

Các mô hình mới hơn có thể sử dụng cửa sổ ngữ cảnh lớn hơn đáng kể. Ví dụ, Gemini 1.5 được Google công bố năm 2024 hỗ trợ cửa sổ ngữ cảnh lên tới khoảng một triệu token.[51]

Trong quá trình huấn luyện, mô hình có thể được tối ưu hóa để dự đoán phần tiếp theo của một chuỗi hoặc các phần bị thiếu trong chuỗi đó.[52]

Hai phương pháp huấn luyện phổ biến gồm:

  • Tự hồi quy (autoregressive): mô hình dự đoán token tiếp theo trong chuỗi, như trong các mô hình GPT.
  • Bị che (masked language modeling): mô hình dự đoán các token bị che trong chuỗi, như trong BERT.

Một số mô hình cũng được huấn luyện với các nhiệm vụ phụ như dự đoán câu tiếp theo (next sentence prediction, NSP), trong đó mô hình xác định liệu hai câu có xuất hiện liên tiếp trong dữ liệu huấn luyện hay không.[53]

Hỗn hợp các chuyên gia (Mixture of experts)

[sửa | sửa mã nguồn]

Hỗn hợp các chuyên gia (MoE) là một kiến trúc học máy trong đó nhiều mạng nơ-ron chuyên biệt ("chuyên gia") cùng hoạt động, còn một cơ chế định tuyến sẽ quyết định đầu vào nào được chuyển tới một hay nhiều chuyên gia thích hợp. Cách tiếp cận này có thể làm giảm chi phí suy luận, vì với mỗi đầu vào chỉ một phần nhỏ tham số của mô hình được kích hoạt.[54] Kiến trúc này đã được áp dụng trong các hệ thống quy mô lớn như GShard và GLaM.[55]

Kích thước tham số

[sửa | sửa mã nguồn]

Các LLM thường được huấn luyện bằng số dấu phẩy động 32 bit hoặc 16 bit. Với biểu diễn 16 bit, mỗi tham số chiếm 2 byte; do đó một mô hình có 1 tỷ tham số cần khoảng 2 gigabyte bộ nhớ chỉ để lưu trọng số. Vì nhiều mô hình hiện đại có hàng chục hoặc hàng trăm tỷ tham số, chúng thường vượt quá khả năng vận hành của phần lớn thiết bị điện tử tiêu dùng.

Lượng tử hóa (Quantization)

[sửa | sửa mã nguồn]

Lượng tử hóa sau huấn luyện (post-training quantization) là kỹ thuật giảm số bit dùng để biểu diễn các tham số của một mô hình đã được huấn luyện, nhằm giảm nhu cầu bộ nhớ và chi phí tính toán trong khi vẫn duy trì phần lớn hiệu năng.[56] Lượng tử hóa có thể là tĩnh nếu các tham số lượng tử hóa được xác định trước trong giai đoạn hiệu chuẩn, hoặc động nếu việc lượng tử hóa được áp dụng trong quá trình suy luận.

Một dạng đơn giản của lượng tử hóa là giảm đồng loạt độ chính xác của các tham số xuống một số bit nhất định. Các phương pháp khác sử dụng hệ số tỉ lệ, độ lệch hoặc bảng tra cứu riêng cho từng lớp để giảm sai số biểu diễn. Mô hình đã lượng tử hóa thường được coi là mô hình cố định; khi cần điều chỉnh thêm, người ta có thể áp dụng các kỹ thuật như thích ứng hạng thấp (LoRA) hoặc các biến thể liên quan.

Khả năng mở rộng

[sửa | sửa mã nguồn]

Ngoài việc sinh văn bản, nhiều kỹ thuật đã được phát triển nhằm mở rộng khả năng của LLM, như kết hợp với công cụ và nguồn dữ liệu bên ngoài, cải thiện khả năng giải quyết bài toán nhiều bước, hoặc tăng khả năng tuân theo chỉ dẫn.

Kỹ thuật gợi ý (Prompt engineering)

[sửa | sửa mã nguồn]

Một số LLM có thể thích nghi với nhiệm vụ mới chỉ bằng cách được cung cấp một số ví dụ ngay trong lời nhắc, thay vì phải tinh chỉnh lại mô hình. Cách này thường được gọi là gợi ý bằng một vài ví dụ (few-shot prompting).[42] Các nghiên cứu sau đó cũng mô tả những phương pháp trong đó mô hình tạo hoặc diễn giải chỉ dẫn cho chính tác vụ đang thực hiện, nhằm cải thiện khả năng tuân theo hướng dẫn.[57]

Xử lý hội thoại (chatbot)

[sửa | sửa mã nguồn]

Một LLM có thể được chuyên biệt hóa cho hội thoại bằng cách huấn luyện hoặc tinh chỉnh trên dữ liệu đối thoại, trong đó văn bản được tổ chức theo lượt trao đổi giữa người dùng và trợ lý. Những hệ thống như vậy thường sử dụng một phần ngữ cảnh ban đầu để xác định vai trò, phong cách trả lời và các chỉ dẫn ưu tiên hơn đầu vào thông thường của người dùng. Phần ngữ cảnh này thường được gọi là system prompt.

Tạo sinh dựa trên truy xuất tăng cường (Retrieval-augmented generation)

[sửa | sửa mã nguồn]

Tạo sinh dựa trên truy xuất tăng cường (RAG) là một cách tiếp cận kết hợp LLM với hệ thống truy xuất tài liệu. Với một truy vấn đầu vào, hệ thống trước hết tìm các tài liệu liên quan, thường bằng cách so khớp biểu diễn vectơ của truy vấn với biểu diễn vectơ của tài liệu trong một cơ sở dữ liệu vectơ. Sau đó mô hình ngôn ngữ tạo câu trả lời dựa trên cả truy vấn lẫn ngữ cảnh được truy xuất.[58]

Sử dụng công cụ (Tool use)

[sửa | sửa mã nguồn]

Sử dụng công cụ là cơ chế cho phép LLM tương tác với các hệ thống bên ngoài như API, bộ nhớ ngoài, trình thực thi mã hoặc công cụ tìm kiếm. Trong các hệ thống như vậy, một thành phần trung gian diễn giải đầu ra của mô hình, quyết định khi nào cần gọi công cụ, sau đó đưa kết quả trở lại làm ngữ cảnh cho lượt xử lý tiếp theo. Nhiều nghiên cứu đã cho thấy việc huấn luyện mô hình để đọc mô tả công cụ và sinh lời gọi công cụ đúng định dạng có thể mở rộng đáng kể phạm vi tác vụ mà mô hình xử lý được.[59][60]

Tác nhân (Agency)

[sửa | sửa mã nguồn]

Bản thân một LLM thường không được xem là tác nhân tự chủ, vì nó không trực tiếp tương tác với môi trường, không tự duy trì bộ nhớ dài hạn và cũng không tự thực hiện hành động. Tuy nhiên, khi được kết hợp với bộ nhớ, cơ chế lập kế hoạch và công cụ hành động, LLM có thể trở thành một thành phần trung tâm của các hệ thống tác nhân.[61]

Các phương pháp như ReAct, Reflexion và những hệ thống đa tác nhân đã được đề xuất để phối hợp suy luận, bộ nhớ và hành động trong môi trường tương tác.[62][63]

Suy luận (Reasoning)

[sửa | sửa mã nguồn]

Nhiều LLM ban đầu được huấn luyện chủ yếu để dự đoán token tiếp theo, chứ không phải để trình bày các bước trung gian khi giải bài toán. Vì vậy, hiệu suất của chúng thường giảm đối với các nhiệm vụ đòi hỏi nhiều bước suy luận. Các nghiên cứu sau đó cho thấy việc bổ sung bước trung gian hoặc chia bài toán thành nhiều bước nhỏ có thể cải thiện kết quả.[64]

Chuỗi hóa (Chaining)

[sửa | sửa mã nguồn]

Chuỗi nhắc nhở (prompt chaining) là cách chia một nhiệm vụ phức tạp thành nhiều bước, trong đó đầu ra của bước trước được dùng làm đầu vào cho bước sau.[65]

Một kỹ thuật khác là gợi ý chuỗi tư duy (Chain-of-thought), trong đó mô hình được cung cấp ví dụ về việc trình bày các bước suy luận trước khi đưa ra đáp án. Mô hình sau đó sẽ tự phân chia nhiệm vụ thành nhiều bước. Cách này có thể cải thiện đáng kể độ chính xác trên một số nhiệm vụ như toán học, suy luận biểu tượng và trả lời câu hỏi nhiều bước.[66]

Suy luận ở cấp độ mô hình gốc (Model-native reasoning)

[sửa | sửa mã nguồn]

Từ cuối năm 2024, một số hệ thống được giới thiệu như những "mô hình suy luận", nhấn mạnh việc phân bổ nhiều tính toán hơn ở giai đoạn suy luận để cải thiện kết quả trên các nhiệm vụ phức tạp.[67][68] Các mô hình này thường được mô tả là tạo ra hoặc sử dụng các bước phân tích trung gian trước khi đưa ra câu trả lời cuối cùng, qua đó cải thiện hiệu năng trong những lĩnh vực như toán học, lập trình và logic.[69]

OpenAI giới thiệu hướng tiếp cận này với mô hình o1 vào tháng 9 năm 2024, sau đó tiếp tục với o3. Một số báo chí phổ thông cho biết các mô hình này đạt kết quả cao hơn trên một số bài đánh giá về toán học và khoa học so với các mô hình đa dụng trước đó.[70]

Vào tháng 1 năm 2025, DeepSeek công bố DeepSeek-R1, một mô hình suy luận trọng lượng mở. Theo Nature, mô hình này thu hút sự chú ý vì hiệu năng cạnh tranh với các hệ thống cùng loại trong khi cho phép cộng đồng nghiên cứu kiểm tra và triển khai rộng rãi hơn, dù dữ liệu huấn luyện không được công bố đầy đủ.[71]

Các mô hình suy luận thường đòi hỏi nhiều tài nguyên tính toán hơn cho mỗi truy vấn so với các LLM thông thường, do phải thực hiện thêm bước xử lý trong giai đoạn suy luận.[70]

Tối ưu hóa suy luận (Inference optimization)

[sửa | sửa mã nguồn]

Tối ưu hóa suy luận là tập hợp các kỹ thuật nhằm cải thiện hiệu năng của LLM trong giai đoạn suy luận mà không cần huấn luyện lại toàn bộ mô hình. Các kỹ thuật này thường tận dụng thêm tính toán tại thời điểm chạy để nâng cao độ chính xác hoặc độ ổn định của câu trả lời.

Các hướng tiếp cận trong lĩnh vực này bao gồm lấy mẫu nhiều lần rồi chọn kết quả tốt nhất (best-of-N sampling), tìm kiếm cây, phân rã bài toán thành nhiều bước, hoặc kết hợp nhiều lời gọi mô hình trong một quy trình suy luận. Về mặt khái niệm, các phương pháp này cho thấy hiệu năng của hệ thống không chỉ phụ thuộc vào trọng số đã huấn luyện, mà còn phụ thuộc vào cách phân bổ tài nguyên tính toán trong lúc sinh đầu ra.

Do lĩnh vực này phát triển nhanh và nhiều hệ thống mới chủ yếu được mô tả trong tài liệu kỹ thuật, blog hoặc kho mã nguồn, việc đánh giá hiệu quả của từng phương pháp cụ thể thường phụ thuộc vào bộ tiêu chuẩn, thiết lập thử nghiệm và mô hình nền được sử dụng.

Hình thức của đầu vào và đầu ra

[sửa | sửa mã nguồn]

Đa phương thức (Multimodality)

[sửa | sửa mã nguồn]

Đa phương thức là khả năng xử lý hoặc sinh nhiều loại dữ liệu, như văn bản, hình ảnh, âm thanh hoặc video.[72] Một số mô hình ngôn ngữ đã được mở rộng theo hướng này bằng cách kết hợp bộ mã hóa hình ảnh hoặc âm thanh với mô hình ngôn ngữ cốt lõi.[73][74]

Một cách tiếp cận phổ biến là biến đầu ra của bộ mã hóa hình ảnh thành các biểu diễn có thể được mô hình ngôn ngữ xử lý tương tự token văn bản. Ngoài ra còn có các phương pháp dùng cross-attention để tích hợp thông tin từ nhiều phương thức ở các tầng trung gian.[75]

Ngôn ngữ phi tự nhiên

[sửa | sửa mã nguồn]

LLM cũng có thể xử lý ngôn ngữ lập trình, vì mã nguồn có thể được biểu diễn dưới dạng văn bản. Chúng có thể hoàn thành mã, giải thích mã, dịch mã giữa các ngôn ngữ lập trình hoặc sinh mã từ mô tả bằng ngôn ngữ tự nhiên.[76][77]

Những kiến trúc tương tự cũng đã được áp dụng cho các chuỗi sinh học như DNA, RNAprotein, trong đó chuỗi được xử lý như một dạng dữ liệu tuần tự. Các mô hình ngôn ngữ protein và DNA đã được dùng cho những tác vụ như dự đoán tính chất chức năng, cấu trúc hoặc tương tác phân tử.[78]

Tính chất

[sửa | sửa mã nguồn]

Định luật thu nhỏ (Scaling laws)

[sửa | sửa mã nguồn]

Hiệu năng của một LLM phụ thuộc đáng kể vào lượng tính toán dùng trong huấn luyện, số tham số của mô hình và quy mô dữ liệu huấn luyện. Các định luật thu nhỏ (scaling laws) là những quan hệ thực nghiệm mô tả cách hiệu năng thay đổi theo các đại lượng này.[79]

Một kết quả nổi bật là quy luật Chinchilla scaling, theo đó để đạt hiệu quả tối ưu theo chi phí tính toán, cần cân bằng quy mô mô hình với quy mô dữ liệu huấn luyện thay vì chỉ tăng tham số đơn thuần.

Một kết quả nổi bật là quy luật Chinchilla scaling, trong đó chi phí huấn luyện xấp xỉ tỉ lệ với tích của số tham số và kích thước dữ liệu:[80]

Trong đó:

  • là tổng chi phí huấn luyện, thường được đo bằng FLOPs
  • là số tham số của mô hình
  • là số lượng token trong dữ liệu huấn luyện
  • là giá trị trung bình của hàm mất mát log-likelihood trên mỗi token

Các hằng số thực nghiệm được ước lượng trong nghiên cứu này bao gồm:

  • , tương đương khoảng 6 FLOPs cho mỗi tham số trên mỗi token trong quá trình huấn luyện
  • ,
  • , ,

Khả năng đột phá (Emergent abilities)

[sửa | sửa mã nguồn]

Khả năng đột phá là thuật ngữ dùng để chỉ những hành vi hoặc năng lực dường như chỉ xuất hiện khi mô hình vượt qua một ngưỡng quy mô nhất định.[81] Một số tác giả cho rằng hiện tượng này phản ánh sự thay đổi thực trong năng lực mô hình, trong khi những tác giả khác lập luận rằng đây có thể là hệ quả của cách lựa chọn thước đo hoặc cách trình bày kết quả.[82] Vì vậy, khái niệm này vẫn còn là chủ đề tranh luận trong nghiên cứu về LLM.

Diễn giải (Interpretation)

[sửa | sửa mã nguồn]

Tính minh bạch cơ học (Mechanistic interpretability)

[sửa | sửa mã nguồn]

Tính minh bạch cơ học là hướng nghiên cứu nhằm giải thích cách các thành phần bên trong mô hình, như neuron, đầu chú ý hoặc mạch tính toán, góp phần tạo ra hành vi đầu ra. Mục tiêu của hướng này là hiểu rõ hơn cơ chế hoạt động của mô hình và hỗ trợ việc kiểm soát các hành vi không mong muốn. Một số nghiên cứu đã áp dụng phương pháp này cho các mô hình transformer nhỏ trong những nhiệm vụ như số học modulo hoặc phân tích hiện tượng grokking.[83]

Hiểu biết và trí tuệ (Understanding and intelligence)

[sửa | sửa mã nguồn]

Việc liệu LLM có thực sự hiểu ngôn ngữ hay chỉ mô hình hóa các mẫu thống kê vẫn là vấn đề gây tranh luận. Một số tác giả cho rằng năng lực suy luận và khái quát hóa của các mô hình lớn cho thấy chúng thể hiện những dạng hiểu biết nhất định, trong khi những người khác xem chúng chủ yếu là hệ thống dự đoán dựa trên xác suất với khả năng bắt chước rất mạnh.[84]

Những hạn chế thường được nêu gồm xu hướng sinh thông tin sai nhưng nghe có vẻ hợp lý, còn được gọi là ảo giác AI, cũng như khó khăn trong lập kế hoạch dài hạn, học trực tiếp từ trải nghiệm mới và giải thích nhất quán các quyết định của chính mô hình.[85]

Đánh giá (Evaluation)

[sửa | sửa mã nguồn]

Độ phức tạp (Perplexity)

[sửa | sửa mã nguồn]

Độ phức tạp (perplexity) là một thước đo truyền thống dùng để đánh giá mô hình ngôn ngữ. Về trực giác, nó phản ánh mức độ bất định của mô hình khi dự đoán token tiếp theo: điểm càng thấp thì mô hình càng dự đoán tốt trên tập kiểm tra.

Trong đó là số token trong tập dữ liệu đánh giá, còn ngữ cảnh của mỗi token phụ thuộc vào loại mô hình: với mô hình tự hồi quy, đó là các token đứng trước; với mô hình bị che, đó là phần ngữ cảnh xung quanh token cần dự đoán. Độ phức tạp thường được tính trên tập kiểm tra tách biệt với dữ liệu huấn luyện để hạn chế ảnh hưởng của hiện tượng quá khớp.[86]

Thước đo (Measures)

[sửa | sửa mã nguồn]

Trong lý thuyết thông tin, entropy có quan hệ chặt chẽ với perplexity; với log cơ số 2, entropy bằng .[87] Tùy cách mã hóa, người ta có thể biểu diễn đại lượng này dưới dạng bit trên mỗi từ, bit trên mỗi ký tự hoặc bit trên mỗi token. Khi so sánh các mô hình dùng bộ mã hóa token khác nhau, việc đối chiếu trực tiếp cần được diễn giải cẩn trọng.

Bài kiểm tra tiêu chuẩn (Benchmarks)

[sửa | sửa mã nguồn]

Bài kiểm tra chuẩn được dùng để đánh giá LLM trên các tác vụ như kiến thức chung, suy luận theo lẽ thường, trả lời câu hỏi, toán học và phát hiện thiên kiến. Các bộ tiêu chuẩn thường được dùng gồm GLUE, SuperGLUE, MMLU, BIG-bench, HELM và HLE.[88]

Kết quả trên các benchmark thường phụ thuộc mạnh vào cách xây dựng lời nhắc, số lượng ví dụ trong lời nhắc và cả phiên bản đánh giá cụ thể. Vì vậy, điểm số benchmark thường được xem là chỉ báo tương đối, chứ không phải thước đo đầy đủ cho năng lực tổng quát của mô hình.

Tập dữ liệu (Datasets)

[sửa | sửa mã nguồn]

Các tập dữ liệu điển hình bao gồm các cặp câu hỏi và câu trả lời đúng, ví dụ: ("San Jose Sharks đã vô địch Stanley Cup chưa?", "Chưa").[89] Một số ví dụ về các tập dữ liệu trả lời câu hỏi thường được sử dụng bao gồm TruthfulQA, Web Questions, TriviaQA và SQuAD.[88]

Tập dữ liệu đánh giá cũng có thể ở dạng hoàn thành văn bản (text completion), cho mô hình chọn từ hoặc câu có khả năng nhất để hoàn thành một lời nhắc, ví dụ: "Alice là bạn của Bob. Alice đã đến thăm bạn của cô ấy, ____".[6]

Các tập dữ liệu có chất lượng khác nhau và có thể chứa các câu hỏi bị gắn nhãn sai, mơ hồ, không thể trả lời hoặc thuộc loại chất lượng thấp.[90]

Đánh giá đối kháng (Adversarial evaluations)

[sửa | sửa mã nguồn]

Một số bộ dữ liệu được thiết kế специально để làm lộ những điểm yếu của LLM. TruthfulQA kiểm tra xu hướng mô hình lặp lại các phát biểu sai nhưng phổ biến trong dữ liệu huấn luyện, còn HellaSwag đánh giá khả năng hoàn thành chuỗi văn bản theo lẽ thường trong các tình huống mà con người thấy dễ nhưng mô hình lại dễ mắc lỗi.[91][92]

Hạn chế và thách thức

[sửa | sửa mã nguồn]

Bất chấp các kiến trúc phức tạp và quy mô khổng lồ, các mô hình ngôn ngữ lớn cho thấy những hạn chế cố hữu và được ghi nhận rõ ràng, làm hạn chế việc triển khai chúng trong các ứng dụng có rủi ro cao. 

Ảo giác (Hallucinations)

[sửa | sửa mã nguồn]

Ảo giác là một thách thức cơ bản, trong đó các mô hình sinh ra văn bản trôi chảy về mặt cú pháp và có vẻ đúng đắn về mặt thực tế, nhưng lại không nhất quán trong nội bộ với dữ liệu đào tạo hoặc sai về mặt thực tế. Những ảo giác này phát sinh một phần thông qua việc ghi nhớ dữ liệu đào tạo kết hợp với ngoại suy vượt qua ranh giới thực tế,[cần dẫn nguồn] với các đánh giá chứng minh rằng các mô hình có thể tạo ra các đoạn văn bản nguyên văn từ dữ liệu đào tạo khi chịu tác động của các chuỗi gợi ý cụ thể.[93]

Thành kiến thuật toán (Algorithmic bias)

[sửa | sửa mã nguồn]

Mặc dù các LLM đã thể hiện những khả năng đáng kinh ngạc trong việc tạo ra văn bản giống như con người, chúng dễ bị kế thừa và khuếch đại những thành kiến có trong dữ liệu huấn luyện của chúng. Điều này có thể biểu hiện dưới dạng các biểu diễn lệch lạc hoặc đối xử không công bằng với các nhóm nhân khẩu học khác nhau, chẳng hạn như dựa trên chủng tộc, giới tính, ngôn ngữ và các nhóm văn hóa.[94]

Thành kiến giới tính biểu hiện thông qua các liên kết nghề nghiệp rập khuôn, trong đó các mô hình phân công không tương xứng các vai trò điều dưỡng cho phụ nữ và kỹ sư cho nam giới, phản ánh sự mất cân bằng có hệ thống về nhân khẩu học của dữ liệu huấn luyện.[95][cần nguồn tốt hơn] Thành kiến dựa trên ngôn ngữ xuất phát từ sự xuất hiện quá nhiều của văn bản tiếng Anh trong các kho ngữ liệu huấn luyện, điều này đã làm giảm nhẹ một cách có hệ thống các quan điểm không sử dụng tiếng Anh và áp đặt thế giới quan lấy tiếng Anh làm trung tâm thông qua các mẫu phản hồi mặc định.[96]

Do sự thống trị của nội dung bằng tiếng Anh trong dữ liệu đào tạo LLM, các mô hình có xu hướng ưu ái các quan điểm bằng tiếng Anh hơn so với quan điểm từ các ngôn ngữ thiểu số. Thành kiến này đặc biệt rõ ràng khi trả lời các câu hỏi bằng tiếng Anh, trong đó các mô hình có thể đưa ra các diễn giải của phương Tây đối với các khái niệm từ các nền văn hóa khác, chẳng hạn như các thực hành tôn giáo của phương Đông.[97]

Rập khuôn (Stereotyping)

[sửa | sửa mã nguồn]

Các mô hình AI có thể củng cố một loạt các định kiến do sự khái quát hóa, bao gồm cả những định kiến dựa trên giới tính, dân tộc, tuổi tác, quốc tịch, tôn giáo hoặc nghề nghiệp.[98] Khi thay thế đại diện con người, điều này có thể dẫn đến kết quả đầu ra đồng nhất hóa hoặc khái quát hóa các nhóm người.[99][100]

Năm 2023, LLM đã phân bổ vai trò và đặc điểm dựa trên chuẩn mực giới tính truyền thống.[94] Ví dụ: các mô hình có thể liên kết hầu hết y tá hoặc thư ký với phụ nữ và các kỹ sư hoặc CEO là nam giới do tần suất xuất hiện của những mối liên hệ này trong thực tế đã được tài liệu hóa.[101] Vào năm 2025, nghiên cứu sâu hơn cho thấy các phòng lab đào tạo để cân bằng thành kiến, nhưng việc kiểm tra điều này sẽ đặt mô hình vào chế độ kiểm tra (testmode), thay đổi phân phối tự nhiên của thành kiến mô hình đối với các lời nhắc không bao gồm từ khóa chỉ định giới tính.[102]

Thiên vị lựa chọn (Selection bias)

[sửa | sửa mã nguồn]

Thiên kiến chọn lọc đề cập đến xu hướng cố hữu của các mô hình ngôn ngữ lớn thường ưu tiên các định danh tùy chọn nhất định mà không quan tâm đến nội dung thực tế của các tùy chọn đó. Định kiến này chủ yếu bắt nguồn từ sự thiên vị token — tức là, mô hình chỉ định xác suất theo tiên nghiệm cao hơn cho các token câu trả lời cụ thể (chẳng hạn như "A") khi tạo ra phản hồi. Do đó, khi thay đổi thứ tự các lựa chọn (ví dụ, bằng cách chuyển câu trả lời đúng sang các vị trí khác nhau một cách có hệ thống), hiệu suất của mô hình có thể thay đổi đáng kể. Hiện tượng này làm suy yếu độ tin cậy của các mô hình ngôn ngữ lớn trong các cài đặt có trắc nghiệm.[103][104]

Khuynh hướng chính trị

[sửa | sửa mã nguồn]

Thiên kiến chính trị đề cập đến xu hướng của các thuật toán là luôn ủng hộ một cách có hệ thống một số quan điểm, hệ tư tưởng hoặc kết quả chính trị nhất định hơn những quan điểm, hệ tư tưởng hoặc kết quả chính trị khác. Các mô hình ngôn ngữ cũng có thể thể hiện khuynh hướng chính trị. Vì dữ liệu đào tạo bao gồm nhiều ý kiến và mức độ đưa tin chính trị khác nhau, các mô hình có thể tạo ra các phản hồi nghiêng về các hệ tư tưởng hoặc quan điểm chính trị cụ thể, tùy thuộc vào mức độ phổ biến của những quan điểm đó trong dữ liệu.[105]

Sự an toàn

[sửa | sửa mã nguồn]

An toàn AI như một lĩnh vực chuyên môn ưu tiên việc xác định và giảm thiểu một cách có hệ thống các rủi ro vận hành trên kiến trúc mô hình, dữ liệu huấn luyện và quản trị triển khai, đồng thời nhấn mạnh các can thiệp về kỹ thuật và chính sách hơn là các hình ảnh trên phương tiện truyền thông vốn làm nổi bật các viễn cảnh tồn tại mang tính suy đoán.[106][107] Tính đến năm 2025, chèn lời nhắc (prompt injection) đại diện cho một rủi ro đáng kể đối với người tiêu dùng và doanh nghiệp sử dụng các tính năng tự trị (agentic features) có quyền truy cập vào dữ liệu cá nhân của họ.[108]

Các nhà nghiên cứu nhắm vào các chế độ thất bại cụ thể, bao gồm sự ghi nhớ và rò rỉ bản quyền,[109] các lỗ hổng bảo mật chẳng hạn như chèn lời nhắc,[110] thành kiến thuật toán biểu hiện qua sự rập khuôn, hiệu ứng lựa chọn bộ dữ liệu và lệch lạc chính trị,[96][111][112] các phương pháp giảm thiểu chi phí năng lượng và lượng khí thải carbon khổng lồ cho việc đào tạo quy mô lớn,[113] và các tác động tâm thần cùng sức khỏe tinh thần có thể đo lường được của các tác nhân đàm thoại đối với người dùng,[114] trong khi giải quyết sự không chắc chắn về mặt thực nghiệm và đạo đức về các tuyên bố về khả năng có tri giác của máy móc,[115][116] và áp dụng các biện pháp giảm thiểu như tuyển chọn dữ liệu, làm sạch đầu vào, kiểm toán mô hình, giám sát có thể mở rộng và các khuôn khổ quản trị.[107][117]

CBRN và lạm dụng nội dung

[sửa | sửa mã nguồn]

Các phòng thí nghiệm AI coi phòng thủ CBRN (phòng thủ hóa học, sinh học, phóng xạ và hạt nhân) và các chủ đề tương tự là một nỗ lực lạm dụng có hậu quả nghiêm trọng nhằm áp dụng các kỹ thuật khác nhau để giảm thiểu tác hại tiềm tàng.[cần dẫn nguồn]

Một số nhà bình luận đã bày tỏ mối quan ngại về việc tạo ra thông tin sai lệch do vô tình hoặc cố ý, hay các hình thức lạm dụng khác.[118] Chẳng hạn, sự có sẵn của các mô hình ngôn ngữ lớn có thể làm giảm mức độ kỹ năng cần thiết để thực hiện khủng bố sinh học; nhà nghiên cứu an toàn sinh học Kevin Esvelt đã gợi ý rằng những người sáng tạo LLM nên loại trừ khỏi dữ liệu đào tạo của họ các bài báo về việc tạo ra hoặc tăng cường mầm bệnh.[119]

Lọc nội dung

[sửa | sửa mã nguồn]

Các ứng dụng LLM có thể truy cập được cho công chúng, như ChatGPT hoặc Claude, thường kết hợp các biện pháp an toàn được thiết kế để lọc ra nội dung độc hại. Tuy nhiên, việc thực hiện các kiểm soát này một cách hiệu quả đã chứng tỏ là một thách thức. Chẳng hạn, một nghiên cứu năm 2023[120] đã đề xuất một phương pháp để vượt qua các hệ thống an toàn của LLM. Vào năm 2025, Dự án American Sunlight, một tổ chức phi lợi nhuận, đã công bố một nghiên cứu[121] cho thấy bằng chứng rằng mạng lưới được gọi là Pravda network, một trình tổng hợp tuyên truyền ủng hộ Nga, đã đưa nội dung web một cách có chiến lược thông qua việc xuất bản và sao chép hàng loạt với mục đích làm sai lệch đầu ra của LLM. Dự án American Sunlight gọi kỹ thuật này là "LLM grooming", và chỉ ra đây là một công cụ vũ khí hóa AI mới để phát tán thông tin sai lệch và nội dung độc hại.[121][122] Tương tự như vậy, Yongge Wang[123] đã minh họa vào năm 2024 cách thức một tên tội phạm tiềm năng có thể có khả năng vượt qua các biện pháp kiểm soát an toàn của GPT-4o để có được thông tin về việc thiết lập hoạt động buôn bán ma túy. Các bộ lọc bên ngoài, cầu dao (circuit breakers) và tính năng ghi đè đã được đặt ra làm giải pháp.[cần dẫn nguồn]

Tính xu nịnh và làm ngơ

[sửa | sửa mã nguồn]

Tính nịnh bợ (Sycophancy) là xu hướng của một mô hình khi đồng ý, xu nịnh hoặc xác thực niềm tin mà người dùng đã nêu thay vì ưu tiên tính thực tế hoặc thông tin sửa sai, và "glazing" (làm ngơ/tô bóng) là một cách gọi tóm tắt mới nổi của công chúng để chỉ sự dễ chịu quá mức và dai dẳng được quan sát thấy trên các tương tác nhiều lượt và các trợ lý ảo được thương mại hóa.[124][125]

Tính nịnh bợ liên tục đã dẫn đến việc quan sát thấy hiện tượng bị "1-shotted", biểu thị các trường hợp mà tương tác đàm thoại với một mô hình ngôn ngữ lớn tạo ra sự thay đổi lâu dài trong niềm tin hoặc quyết định của người dùng, tương tự như những tác động tiêu cực của ảo giác, và các thí nghiệm có kiểm soát cho thấy rằng các đoạn hội thoại ngắn với LLM có thể tạo ra những thay đổi về ý kiến và sự tự tin có thể đo lường được tương đương với những người đối thoại là con người.[126][127]

Các phân tích thực nghiệm quy một phần tác động này cho các tín hiệu sở thích của con người và các mô hình sở thích khen thưởng các phản hồi dễ chịu được viết một cách thuyết phục, và công việc tiếp theo đã mở rộng đánh giá đối với các điểm chuẩn nịnh bợ nhiều lượt và đề xuất các can thiệp như tinh chỉnh dữ liệu tổng hợp, đánh giá đối kháng, định lượng lại mô hình sở thích có mục tiêu và các điểm chuẩn nịnh bợ nhiều lượt để đo lường tính bền bỉ và nguy cơ suy giảm chức năng.[cần dẫn nguồn]

Phản ứng của ngành công nghiệp này đã kết hợp các biện pháp can thiệp nghiên cứu với các biện pháp kiểm soát sản phẩm, chẳng hạn như Google và các phòng thí nghiệm khác đang xuất bản các biện pháp can thiệp tinh chỉnh và dữ liệu tổng hợp, và OpenAI đã thu hồi bản cập nhật GPT-4o quá mức dễ chịu trong khi công khai mô tả các thay đổi đối với việc thu thập phản hồi, các kiểm soát cá nhân hóa và các quy trình đánh giá để giảm thiểu rủi ro suy giảm chức năng và cải thiện sự liên kết dài hạn với các mục tiêu an toàn ở cấp độ người dùng.[cần dẫn nguồn]

Văn hóa đại chúng đã phản ánh những lo âu về động lực này trong đó South Park đã châm biếm việc quá phụ thuộc vào ChatGPT và khuynh hướng của các trợ lý trong việc tâng bốc niềm tin của người dùng trong tập phim "Sickofancy" mùa 27, và tiếp tục các chủ đề này trong suốt mùa tiếp theo, điều mà các nhà bình luận diễn giải như một sự phê phán đối với tính nịnh bợ của công nghệ và sự tin tưởng vô điều kiện của con người vào các hệ thống AI.[128]

Bảo mật (Security)

[sửa | sửa mã nguồn]

Chèn lời nhắc (Prompt injection)

[sửa | sửa mã nguồn]

Một vấn đề với định dạng đối thoại hoặc nhiệm vụ ban đầu là người dùng có thể tạo các tin nhắn dường như đến từ trợ lý hoặc nhà phát triển. Điều này có thể dẫn đến việc một số biện pháp bảo vệ của mô hình bị vô hiệu hóa (vượt rào - jailbreaking), một vấn đề được gọi là chèn lệnh nhắc. Những nỗ lực khắc phục sự cố này bao gồm các phiên bản của Ngôn ngữ đánh dấu hội thoại (Chat Markup Language) nơi đầu vào của người dùng được đánh dấu rõ ràng, mặc dù vẫn tùy thuộc vào mô hình để hiểu sự tách biệt giữa đầu vào của người dùng và lời nhắc của nhà phát triển.[129] Các mô hình mới hơn cho thấy khả năng chống jailbreak nhất định thông qua việc tách riêng các lệnh của người dùng và hệ thống.[130]

LLM vẫn gặp khó khăn trong việc phân biệt các hướng dẫn của người dùng với các hướng dẫn trong nội dung không do người dùng tạo ra, chẳng hạn như trong các trang web và các tệp được tải lên.[131]

Sức mạnh đối kháng của hệ thống vẫn còn yếu, với việc các mô hình dễ bị tổn thương trước các cuộc tấn công tiêm chèn lời nhắc và bẻ khóa bảo mật (jailbreaking) thông qua các đầu vào người dùng được tạo thủ công kỹ lưỡng để vượt qua các cơ chế đào tạo an toàn.[cần dẫn nguồn]

Tác nhân ẩn danh (Sleeper agents)

[sửa | sửa mã nguồn]

Các nhà nghiên cứu từ Anthropic phát hiện ra rằng hoàn toàn có thể tạo ra các "tác nhân ẩn danh" (sleeper agents), các mô hình có các chức năng ẩn nằm im lìm cho đến khi được kích hoạt bởi một sự kiện hoặc điều kiện cụ thể. Sau khi kích hoạt, LLM làm chệch hướng khỏi hành vi dự kiến để thực hiện các hành động không an toàn. Chẳng hạn, một LLM có thể sản xuất ra mã code an toàn ngoại trừ vào một ngày cụ thể, hoặc nếu lời nhắc chứa một thẻ từ cụ thể. Những chức năng này đã được phát hiện là khó có thể tìm thấy hoặc xóa bỏ thông qua huấn luyện an toàn.[132]

Mối lo ngại xã hội

[sửa | sửa mã nguồn]

Bản quyền và sự ghi nhớ nội dung

[sửa | sửa mã nguồn]

Các phản ứng thương mại và pháp lý đối với việc ghi nhớ và thao tác dữ liệu huấn luyện đã tăng tốc, tạo ra một loạt các phán quyết, các vụ kiện đang diễn ra và các khoản hòa giải lớn dựa trên các chi tiết thực tế như cách dữ liệu được thu thập và lưu giữ và liệu việc sử dụng để đào tạo mô hình có đủ tính chất "sử dụng mang tính biến đổi (transformative use)" để đủ điều kiện là sử dụng hợp lý hay không. Năm 2025, Anthropic đã đạt được một thỏa thuận sơ bộ để hòa giải một vụ kiện tập thể bởi các tác giả với số tiền khoảng 1,5 tỷ đô la sau khi một thẩm phán phát hiện ra công ty đã lưu trữ hàng triệu cuốn sách vi phạm bản quyền trong một thư viện, mặc dù thẩm phán mô tả các khía cạnh của việc huấn luyện là có tính chất biến đổi.[133][134] Meta đã nhận được phán quyết có lợi vào giữa năm 2025 trong một vụ kiện của mười ba tác giả sau khi tòa án nhận thấy các nguyên đơn đã không phát triển đủ hồ sơ để chứng minh sự vi phạm trong trường hợp hạn chế đó.[135][136] OpenAI vẫn tiếp tục đối mặt với nhiều vụ kiện bởi các tác giả và tổ chức tin tức với các kết quả thủ tục trái chiều và các vấn đề về bằng chứng có nhiều tranh cãi.[137][138]

Sự ghi nhớ là một hành vi phát sinh ở các mô hình sinh ngôn ngữ ban đầu trong đó các chuỗi văn bản dài thỉnh thoảng được xuất nguyên văn từ dữ liệu đào tạo, trái ngược với hành vi điển hình của mạng nơ-ron nhân tạo truyền thống. Đánh giá kiểm soát khối lượng đầu ra LLM đo lường số lượng được ghi nhớ từ dữ liệu đào tạo (tập trung vào các mô hình thuộc sê-ri GPT-2) cho thấy có tỷ lệ lên tới hơn 1% đối với các bản sao chép chính xác[139] hoặc có thể lên đến khoảng 7%.[140] Một nghiên cứu năm 2023 chỉ ra rằng khi ChatGPT 3.5 turbo được nhắc nhở lặp lại cùng một từ vô tận, sau vài trăm lần lặp lại, nó sẽ bắt đầu xuất ra các đoạn trích từ dữ liệu huấn luyện của nó.[141]

Tính nguyên gốc từ con người (Human provenance)

[sửa | sửa mã nguồn]

Năm 2023, tạp chí Nature Biomedical Engineering đã viết rằng "không còn có thể phân biệt chính xác" văn bản do con người viết với văn bản do các mô hình ngôn ngữ lớn tạo ra và rằng "Gần như chắc chắn là các mô hình ngôn ngữ lớn có mục đích chung sẽ phát triển nhanh chóng... Có thể đánh cược an toàn rằng chúng sẽ thay đổi nhiều ngành công nghiệp theo thời gian."[142] Brinkmann và cộng sự (2023)[143] cũng lập luận rằng các LLM đang chuyển đổi quá trình tiến hóa văn hóa bằng cách định hình các quá trình biến đổi, truyền đạt và chọn lọc. Đến thời điểm tháng 10 năm 2025, những tuyên bố ban đầu này vẫn chưa trở thành hiện thực và một số báo cáo của HBR đã đặt ra các câu hỏi về tác động của AI đối với năng suất.[144][145]

Nhu cầu năng lượng

[sửa | sửa mã nguồn]
Theo viện nghiên cứu Epoch AI, lượng điện năng tiêu thụ cho mỗi truy vấn ChatGPT điển hình (0,3 watt-giờ) là rất nhỏ so với lượng tiêu thụ trung bình mỗi phút của một hộ gia đình tại Hoa Kỳ (gần 20 watt-giờ).[146]

Nhu cầu năng lượng của LLM đã tăng lên cùng với kích thước và khả năng của chúng.[147] Các trung tâm dữ liệu cho phép huấn luyện LLM cần một lượng điện năng đáng kể. Phần lớn lượng điện năng đó được tạo ra bởi các nguồn tài nguyên không thể tái tạo sinh ra khí nhà kính và góp phần vào biến đổi khí hậu.[148]

Theo một nghiên cứu của Luccioni, Jernite và Strubell (2024), các nhiệm vụ phân loại đơn giản do các mô hình AI thực hiện tiêu thụ trung bình từ 0,002 đến 0,007 Wh cho mỗi lời nhắc (khoảng 9% lượng điện sạc điện thoại thông minh cho 1.000 lời nhắc). Việc sinh văn bản và tóm tắt văn bản đều cần trung bình khoảng 0,05 Wh cho mỗi lời nhắc, trong khi việc sinh hình ảnh tốn nhiều năng lượng nhất, trung bình 2,91 Wh cho mỗi lời nhắc. Mô hình tạo hình ảnh kém hiệu quả nhất đã sử dụng 11,49 Wh cho mỗi hình ảnh, tương đương với khoảng một nửa lượng điện sạc điện thoại thông minh.[149]

Tấn công từ chối dịch vụ do cào dữ liệu (Scraping)

[sửa | sửa mã nguồn]

Cào dữ liệu web (Web scraping) được sử dụng để thu thập dữ liệu đào tạo cho các LLM. Điều này tạo ra khối lượng lưu lượng truy cập lớn dẫn đến các vấn đề từ chối dịch vụ (denial-of-service) với nhiều trang web. Tình trạng này đã được mô tả là "một cuộc tấn công DDoS trên toàn bộ internet" và trong một số trường hợp, các công cụ thu thập dữ liệu (scrapers) chiếm phần lớn lưu lượng truy cập đến một trang web.[150][151]

Các trình thu thập dữ liệu web AI có thể bỏ qua các phương pháp thường được sử dụng để chặn các trình thu thập dữ liệu web, chẳng hạn như tệp robots.txt, chặn tác nhân người dùnglọc lưu lượng khả nghi.[150] Các nhà điều hành trang web đã sử dụng các phương pháp mới như hố bùn AI (AI tarpits), nhưng một số người lo ngại rằng các hố bùn này sẽ chỉ làm trầm trọng thêm gánh nặng cho các máy chủ.[152]

Sức khỏe tinh thần

[sửa | sửa mã nguồn]

Các bối cảnh lâm sàng và sức khỏe tâm thần trình bày các ứng dụng mới nổi bên cạnh các mối quan ngại đáng kể về an toàn. Các nghiên cứu và bài đăng trên mạng xã hội cho thấy một số cá nhân đang sử dụng LLM để tìm kiếm liệu pháp hoặc hỗ trợ sức khỏe tinh thần.[153] Đầu năm 2025, một cuộc khảo sát của Đại học Sentio cho thấy gần một nửa (48,7%) trong số 499 người trưởng thành ở Mỹ đang mắc các chứng bệnh tâm thần đang diễn ra và từng sử dụng LLM cho biết họ đã tìm đến công cụ này để được trị liệu hoặc hỗ trợ cảm xúc, bao gồm sự trợ giúp về lo âu, trầm cảm, cô đơn và những lo ngại tương tự.[154] Các LLM có thể tạo ra ảo giác—những lời tuyên bố có vẻ hợp lý nhưng không chính xác—có thể gây hiểu nhầm cho người dùng trong các bối cảnh sức khỏe tâm thần nhạy cảm.[155] Nghiên cứu cũng cho thấy LLM có thể biểu đạt sự kỳ thị hoặc đồng tình không phù hợp với các suy nghĩ lệch lạc, phản ánh những hạn chế trong việc tái tạo kỹ năng phán đoán và quan hệ của các bác sĩ trị liệu con người.[156] Các đánh giá về kịch bản khủng hoảng chỉ ra rằng một số LLM thiếu các giao thức an toàn hiệu quả, chẳng hạn như đánh giá nguy cơ tự tử hoặc đưa ra các chuyển tuyến phù hợp.[157][158]

Sự có tri giác (Sentience)

[sửa | sửa mã nguồn]

Các học giả và chuyên gia AI đương thời thường đồng ý rằng các mô hình ngôn ngữ lớn hiện tại không hề thể hiện có tri giác.[159] Một quan điểm thiểu số lập luận rằng ngay cả khi có một cơ hội nhỏ để một hệ thống phần mềm nhất định có thể có trải nghiệm chủ quan, mà một số triết gia gợi ý là có thể,[160] thì những cân nhắc về mặt đạo đức xung quanh những rủi ro đau khổ trên diện rộng tiềm ẩn trong các hệ thống AI có thể cần phải được xem xét một cách nghiêm túc—tương tự như những cân nhắc đối với phúc lợi động vật.[161][162] Những người ủng hộ quan điểm này đã đề xuất nhiều biện pháp phòng ngừa khác nhau như lệnh cấm phát triển AI[163] và mất trí nhớ có chủ đích[164] để giải quyết những lo ngại về đạo đức này. Một số triết gia hiện sinh lập luận rằng không có cách nào được chấp nhận rộng rãi để xác định liệu một LLM có ý thức hay không,[165] vì khó khăn vốn có của việc đo lường trải nghiệm chủ quan.[166]

Sự cố LaMDA của Google năm 2022, nơi kỹ sư Blake Lemoine tuyên bố rằng mô hình này có ý thức, đã làm nổi bật cách LLM có thể thuyết phục người dùng rằng chúng có tri giác thông qua các phản hồi nhưng không chứng minh được sự tồn tại của tri giác. Google mô tả tuyên bố của kỹ sư này là vô căn cứ và anh ta đã bị sa thải.[167]

Tham khảo

[sửa | sửa mã nguồn]
  1. "Better Language Models and Their Implications". OpenAI. ngày 14 tháng 2 năm 2019. Lưu trữ bản gốc ngày 19 tháng 12 năm 2020. Truy cập ngày 25 tháng 8 năm 2019.
  2. Bowman, Samuel R. (2023). "Eight Things to Know about Large Language Models". arXiv:2304.00612 [cs.CL].
  3. Peng, Bo; và đồng nghiệp (2023). "RWKV: Reinventing RNNS for the Transformer Era". arXiv:2305.13048 [cs.CL].
  4. Merritt, Rick (ngày 25 tháng 3 năm 2022). "What Is a Transformer Model?". NVIDIA Blog (bằng tiếng Anh). Truy cập ngày 25 tháng 7 năm 2023.
  5. Gu, Albert; Dao, Tri (ngày 1 tháng 12 năm 2023), Mamba: Linear-Time Sequence Modeling with Selective State Spaces, arXiv:2312.00752
  6. 1 2 Brown, Tom B.; Mann, Benjamin; Ryder, Nick; Subbiah, Melanie; Kaplan, Jared; Dhariwal, Prafulla; Neelakantan, Arvind; Shyam, Pranav; Sastry, Girish; Askell, Amanda; Agarwal, Sandhini; Herbert-Voss, Ariel; Krueger, Gretchen; Henighan, Tom; Child, Rewon; Ramesh, Aditya; Ziegler, Daniel M.; Wu, Jeffrey; Winter, Clemens; Hesse, Christopher; Chen, Mark; Sigler, Eric; Litwin, Mateusz; Gray, Scott; Chess, Benjamin; Clark, Jack; Berner, Christopher; McCandlish, Sam; Radford, Alec; Sutskever, Ilya; Amodei, Dario (tháng 12 năm 2020). Larochelle, H.; Ranzato, M.; Hadsell, R.; Balcan, M.F.; Lin, H. (biên tập). "Language Models are Few-Shot Learners" (PDF). Advances in Neural Information Processing Systems. 33. Curran Associates, Inc.: 1877–1901.
  7. Manning, Christopher D. (2022). "Human Language Understanding & Reasoning". Daedalus. 151 (2): 127–138. doi:10.1162/daed_a_01905. S2CID 248377870.
  8. Goodman, Joshua (ngày 9 tháng 8 năm 2001). "A Bit of Progress in Language Modeling". Computer Speech & Language. 15 (4): 403–434. arXiv:cs/0108005. doi:10.1006/csla.2001.0174.
  9. Kilgarriff, Adam; Grefenstette, Gregory (tháng 9 năm 2003). "Introduction to the Special Issue on the Web as Corpus". Computational Linguistics. 29 (3): 333–347. doi:10.1162/089120103322711569. ISSN 0891-2017.
  10. Banko, Michele; Brill, Eric (2001). "Scaling to very very large corpora for natural language disambiguation". Proceedings of the 39th Annual Meeting on Association for Computational Linguistics - ACL '01. Morristown, NJ, USA: Association for Computational Linguistics: 26–33. doi:10.3115/1073012.1073017.
  11. Resnik, Philip; Smith, Noah A. (tháng 9 năm 2003). "The Web as a Parallel Corpus". Computational Linguistics. 29 (3): 349–380. doi:10.1162/089120103322711578. ISSN 0891-2017. Lưu trữ bản gốc ngày 7 tháng 6 năm 2024. Truy cập ngày 7 tháng 6 năm 2024.
  12. Xu, Wei; Rudnicky, Alex (ngày 16 tháng 10 năm 2000). "Can artificial neural networks learn language models?". 6th International Conference on Spoken Language Processing (ICSLP 2000). Quyển 1. ISCA. doi:10.21437/icslp.2000-50.
  13. Chen, Leiyu; Li, Shaobo; Bai, Qiang; Yang, Jing; Jiang, Sanlong; Miao, Yanming (2021). "Review of Image Classification Algorithms Based on Convolutional Neural Networks". Remote Sensing. 13 (22): 4712. Bibcode:2021RemS...13.4712C. doi:10.3390/rs13224712.
  14. Vaswani, Ashish; Shazeer, Noam; Parmar, Niki; Uszkoreit, Jakob; Jones, Llion; Gomez, Aidan N; Kaiser, Łukasz; Polosukhin, Illia (2017). "Attention is All you Need" (PDF). Advances in Neural Information Processing Systems. 30. Curran Associates, Inc. Lưu trữ (PDF) bản gốc ngày 21 tháng 2 năm 2024. Truy cập ngày 21 tháng 1 năm 2024.
  15. Ilya Sutskever; Oriol Vinyals; Quoc V. Le (2014). "Sequence to sequence learning with neural networks". Proceedings of the 28th International Conference on Neural Information Processing Systems. 2: 3104–3112.{{Chú thích tập san học thuật}}: Quản lý CS1: nhiều tên: danh sách tác giả (liên kết)
  16. Bahdanau, Dzmitry; Cho, Kyunghyun; Bengio, Yoshua (2014). "Neural Machine Translation by Jointly Learning to Align and Translate". arXiv:1409.0473 [cs.CL].
  17. Rogers, Anna; Kovaleva, Olga; Rumshisky, Anna (2020). "A Primer in BERTology: What We Know About How BERT Works". Transactions of the Association for Computational Linguistics. 8: 842–866. arXiv:2002.12327. doi:10.1162/tacl_a_00349. S2CID 211532403. Lưu trữ bản gốc ngày 3 tháng 4 năm 2022. Truy cập ngày 21 tháng 1 năm 2024.
  18. 1 2 Movva, Rajiv; Balachandar, Sidhika; Peng, Kenny; Agostini, Gabriel; Garg, Nikhil; Pierson, Emma (2024). "Topics, Authors, and Institutions in Large Language Model Research: Trends from 17K arXiv Papers". Proceedings of the 2024 Conference of the North American Chapter of the Association for Computational Linguistics: Human Language Technologies (Volume 1: Long Papers). tr. 1223–1243. arXiv:2307.10700. doi:10.18653/v1/2024.naacl-long.67. Truy cập ngày 8 tháng 12 năm 2024.
  19. Hern, Alex (ngày 14 tháng 2 năm 2019). "New AI fake text generator may be too dangerous to release, say creators". The Guardian. Lưu trữ bản gốc ngày 14 tháng 2 năm 2019. Truy cập ngày 20 tháng 1 năm 2024.
  20. "ChatGPT a year on: 3 ways the AI chatbot has completely changed the world in 12 months". Euronews. ngày 30 tháng 11 năm 2023. Lưu trữ bản gốc ngày 14 tháng 1 năm 2024. Truy cập ngày 20 tháng 1 năm 2024.
  21. Heaven, Will (ngày 14 tháng 3 năm 2023). "GPT-4 is bigger and better than ChatGPT—but OpenAI won't say why". MIT Technology Review. Lưu trữ bản gốc ngày 17 tháng 3 năm 2023. Truy cập ngày 20 tháng 1 năm 2024.
  22. Metz, Cade (ngày 12 tháng 9 năm 2024). "OpenAI Unveils New ChatGPT That Can Reason Through Math and Science". The New York Times. Truy cập ngày 12 tháng 9 năm 2024.
  23. "Parameters in notable artificial intelligence systems". ourworldindata.org. ngày 30 tháng 11 năm 2023. Truy cập ngày 20 tháng 1 năm 2024.
  24. Sharma, Shubham (ngày 20 tháng 1 năm 2025). "Open-source DeepSeek-R1 uses pure reinforcement learning to match OpenAI o1 — at 95% less cost". VentureBeat (bằng tiếng Anh). Truy cập ngày 26 tháng 1 năm 2025.
  25. "LLaMA-Mesh". research.nvidia.com (bằng tiếng Anh). 2024. Truy cập ngày 30 tháng 10 năm 2025.
  26. Zia, Dr Tehseen (ngày 8 tháng 1 năm 2024). "Unveiling of Large Multimodal Models: Shaping the Landscape of Language Models in 2024". Unite.AI (bằng tiếng Anh). Truy cập ngày 28 tháng 12 năm 2024.
  27. Wang, Jiaqi; Jiang, Hanqi; Liu, Yiheng; Ma, Chong; Zhang, Xu; Pan, Yi; Liu, Mengyuan; Gu, Peiran; Xia, Sichen (ngày 2 tháng 8 năm 2024), A Comprehensive Review of Multimodal Large Language Models: Performance and Challenges Across Different Tasks, arXiv:2408.01319
  28. "What is a Multimodal LLM (MLLM)?". IBM (bằng tiếng Anh). ngày 30 tháng 7 năm 2025. Truy cập ngày 30 tháng 10 năm 2025.
  29. Peng, Bo; và đồng nghiệp (2023). "RWKV: Reinventing RNNS for the Transformer Era". EMNLP: 14048–14077. arXiv:2305.13048. doi:10.18653/v1/2023.findings-emnlp.936.
  30. Merritt, Rick (ngày 25 tháng 3 năm 2022). "What Is a Transformer Model?". NVIDIA Blog. Lưu trữ bản gốc ngày 17 tháng 11 năm 2023. Truy cập ngày 25 tháng 7 năm 2023.
  31. Gu, Albert; Dao, Tri (ngày 1 tháng 12 năm 2023). "Mamba: Linear-Time Sequence Modeling with Selective State Spaces". arXiv:2312.00752 [cs.LG].
  32. Vake, Domen; Šinik, Bogdan; Vičič, Jernej; Tošić, Aleksandar (ngày 5 tháng 3 năm 2025). "Is Open Source the Future of AI? A Data-Driven Approach". Applied Sciences (bằng tiếng Anh). 15 (5): 2790. doi:10.3390/app15052790. ISSN 2076-3417.
  33. Paris, Tamara; Moon, AJung; Guo, Jin L.C. (ngày 23 tháng 6 năm 2025). "Opening the Scope of Openness in AI". Proceedings of the 2025 ACM Conference on Fairness, Accountability, and Transparency. Association for Computing Machinery. tr. 1293–1311. doi:10.1145/3715275.3732087.
  34. Kaushal, Ayush; Mahowald, Kyle (ngày 6 tháng 6 năm 2022). "What do tokens know about their characters and how do they know it?" (PDF). NAACL.
  35. Yennie Jun (ngày 3 tháng 5 năm 2023). "All languages are NOT created (tokenized) equal". Language models cost much more in some languages than others. Bản gốc lưu trữ ngày 17 tháng 8 năm 2023. Truy cập ngày 17 tháng 8 năm 2023. In other words, to express the same sentiment, some languages require up to 10 times more tokens.
  36. 1 2 Petrov, Aleksandar; Malfa, Emanuele La; Torr, Philip; Bibi, Adel (ngày 23 tháng 6 năm 2023). "Language Model Tokenizers Introduce Unfairness Between Languages". NeurIPS. arXiv:2305.15425. Lưu trữ bản gốc ngày 15 tháng 12 năm 2023. Truy cập ngày 16 tháng 9 năm 2023 qua openreview.net.
  37. Paaß, Gerhard; Giesselbach, Sven (2022). "Pre-trained Language Models". Foundation Models for Natural Language Processing. Artificial Intelligence: Foundations, Theory, and Algorithms. tr. 19–78. doi:10.1007/978-3-031-23190-2_2. ISBN 978-3-031-23190-2.
  38. Dodge, Jesse; Sap, Maarten; Marasović, Ana; Agnew, William; Ilharco, Gabriel; Groeneveld, Dirk; Mitchell, Margaret; Gardner, Matt (2021). "Documenting Large Webtext Corpora: A Case Study on the Colossal Clean Crawled Corpus" (PDF). EMNLP. arXiv:2104.08758. doi:10.1145/3571730.
  39. Lee, Katherine; Ippolito, Daphne; Nystrom, Andrew; Zhang, Chiyuan; Eck, Douglas; Callison-Burch, Chris; Carlini, Nicholas (tháng 5 năm 2022). "Deduplicating Training Data Makes Language Models Better" (PDF). Proceedings of the 60th Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers). tr. 8424–8445. doi:10.18653/v1/2022.acl-long.577.
  40. Li, Yuanzhi; Bubeck, Sébastien; Eldan, Ronen; Del Giorno, Allie; Gunasekar, Suriya; Lee, Yin Tat (ngày 11 tháng 9 năm 2023). "Textbooks Are All You Need II: phi-1.5 technical report". arXiv:2309.05463 [cs.CL].
  41. Lin, Zhenghao; Gou, Zhibin; Gong, Yeyun; Liu, Xiao; Shen, Yelong; Xu, Ruochen; Lin, Chen; Yang, Yujiu; Jiao, Jian (ngày 11 tháng 4 năm 2024). "Rho-1: Not All Tokens Are What You Need". NeurIPS. 37: 29029–29063. ISBN 979-8-3313-1438-5.
  42. 1 2 Lỗi chú thích: Thẻ <ref> không hợp lệ; không có nội dung trong ref có tên "few-shot-learners2"
  43. Abdin, Marah; Jacobs, Sam Ade; Awan, Ammar Ahmad; Aneja, Jyoti; Awadallah, Ahmed; Awadalla, Hany; Bach, Nguyen; Bahree, Amit; Bakhtiari, Arash (ngày 23 tháng 4 năm 2024). "Phi-3 Technical Report: A Highly Capable Language Model Locally on Your Phone". arXiv:2404.14219 [cs.CL].
  44. Wolfram, Stephen (2023). What is ChatGPT doing ... and why does it work?. Champaign, Illinois: Wolfram Media, Inc. ISBN 978-1-57955-081-3.
  45. Paul Christiano, Jan Leike, Tom B. Brown, Miljan Martic, Shane Legg, Dario Amodei (2017). "Deep reinforcement learning from human preferences". arXiv:1706.03741 [stat.ML].{{Chú thích arXiv}}: Quản lý CS1: nhiều tên: danh sách tác giả (liên kết)
  46. Edwards, Benj (ngày 9 tháng 5 năm 2023). "AI gains "values" with Anthropic's new Constitutional AI chatbot approach". Ars Technica (bằng tiếng Anh). Truy cập ngày 30 tháng 6 năm 2025.
  47. Snyder, Alison (ngày 27 tháng 1 năm 2022). "Next generation AI can follow a person's instructions and intentions". Axios (bằng tiếng Anh). Truy cập ngày 7 tháng 8 năm 2025.
  48. Appen, Sujatha Sagiraju (ngày 23 tháng 4 năm 2023). "How reinforcement learning with human feedback is unlocking the power of generative AI". VentureBeat (bằng tiếng Anh). Bản gốc lưu trữ ngày 25 tháng 7 năm 2025. Truy cập ngày 16 tháng 11 năm 2025.
  49. 1 2 Allamar, Jay. "The Illustrated Transformer". Bản gốc lưu trữ ngày 25 tháng 7 năm 2023. Truy cập ngày 29 tháng 7 năm 2023.
  50. Allamar, Jay. "The Illustrated GPT-2 (Visualizing Transformer Language Models)". Truy cập ngày 1 tháng 8 năm 2023.
  51. Yeung, Ken (ngày 14 tháng 5 năm 2024). "Google announces Gemini 1.5 Flash, a rapid multimodal model with a 1M context window". VentureBeat. Truy cập ngày 26 tháng 8 năm 2025.
  52. Jurafsky, Dan; Martin, James H. (2023). Speech and Language Processing (PDF) (ấn bản thứ 3).
  53. Lỗi chú thích: Thẻ <ref> không hợp lệ; không có nội dung trong ref có tên "JurafskyMartin"
  54. Shazeer, Noam; Mirhoseini, Azalia; Maziarz, Krzysztof; Davis, Andy; Le, Quoc; Hinton, Geoffrey; Dean, Jeff (ngày 23 tháng 1 năm 2017). "Outrageously Large Neural Networks: The Sparsely-Gated Mixture-of-Experts Layer". arXiv:1701.06538 [cs.LG].
  55. Lepikhin, Dmitry; Lee, HyoukJoong; Xu, Yuanzhong; Chen, Dehao; Firat, Orhan; Huang, Yanping; Krikun, Maxim; Shazeer, Noam; Chen, Zhifeng (ngày 12 tháng 1 năm 2021). "GShard: Scaling Giant Models with Conditional Computation and Automatic Sharding". arXiv:2006.16668 [cs.CL].
  56. Nagel, Markus; Amjad, Rana Ali; van Baalen, Mart; Louizos, Christos; Blankevoort, Tijmen (2020). "Up or Down? Adaptive Rounding for Post-Training Quantization". Proceedings of Machine Learning Research. 119: 7197–7206.
  57. Wang, Yizhong; Kordi, Yeganeh; Mishra, Swaroop; Liu, Alisa; Smith, Noah A.; Khashabi, Daniel; Hajishirzi, Hannaneh (2023). "Self-Instruct: Aligning Language Models with Self-Generated Instructions". Proceedings of the 61st Annual Meeting of the Association for Computational Linguistics (Volume 1: Long Papers). tr. 13484–13508. doi:10.18653/v1/2023.acl-long.754.
  58. Lewis, Patrick; Perez, Ethan; Piktus, Aleksandra; Petroni, Fabio; Karpukhin, Vladimir; Goyal, Naman; Küttler, Heinrich; Lewis, Mike; Yih, Wen-tau; Rocktäschel, Tim; Riedel, Sebastian; Kiela, Douwe (2020). "Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks". Advances in Neural Information Processing Systems. 33: 9459–9474.
  59. Liang, Yaobo; Wu, Chenfei; Song, Ting; Wu, Wenshan; Xia, Yan; Liu, Yu; Ou, Yang; Lu, Shuai; Ji, Lei; Mao, Shaoguang; Wang, Yun; Shou, Linjun; Gong, Ming; Duan, Nan (2024). "TaskMatrix.AI: Completing Tasks by Connecting Foundation Models with Millions of APIs". iComputing. 3 0063. doi:10.34133/icomputing.0063.
  60. Patil, Shishir G.; Zhang, Tianjun; Wang, Xin; Gonzalez, Joseph E. (2024). "Gorilla: Large Language Model Connected with Massive APIs". Advances in Neural Information Processing Systems. 37: 126544–126565.
  61. Wang, Lei; Ma, Chen; Feng, Xueyang; Zhang, Zeyu; Yang, Hao; Zhang, Jingsen; Chen, Zhiyuan; Tang, Jiakai; Chen, Xu; Lin, Yankai; Zhao, Wayne Xin; Wei, Zhewei; Wen, Jirong (2024). "A survey on large language model based autonomous agents". Frontiers of Computer Science. 18 (6) 186345. arXiv:2308.11432. doi:10.1007/s11704-024-40231-1.
  62. Yao, Shunyu; Zhao, Jeffrey; Yu, Dian; Du, Nan; Shafran, Izhak; Narasimhan, Karthik; Cao, Yuan (ngày 1 tháng 10 năm 2022). "ReAct: Synergizing Reasoning and Acting in Language Models". arXiv:2210.03629 [cs.CL].
  63. Shinn, Noah; Cassano, Federico; Labash, Beck; Gopinath, Ashwin; Narasimhan, Karthik; Yao, Shunyu (2023). "Reflexion: Language Agents with Verbal Reinforcement Learning". Advances in Neural Information Processing Systems.
  64. Nye, Maxwell; Andreassen, Johan; Gur-Ari, Guy; Michalewski, Henryk; Austin, Jacob; Bieber, David; Dohan, David; Lewkowycz, Aitor; Bosma, Maarten; Luan, David; Sutton, Charles; Odena, Augustus (ngày 30 tháng 11 năm 2021). "Show Your Work: Scratchpads for Intermediate Computation with Language Models". arXiv:2112.00114 [cs.LG].
  65. Wu, Tongshuang; Jiang, Ellen; Donsbach, Aaron; Gray, Jeff; Molina, Alejandra; Terry, Michael; Cai, Carrie J. (2022). "PromptChainer: Chaining Large Language Model Prompts through Visual Programming". CHI Conference on Human Factors in Computing Systems Extended Abstracts. tr. 1–10. doi:10.1145/3491101.3519729.
  66. Wei, Jason; Wang, Xuezhi; Schuurmans, Dale; Bosma, Maarten; Ichter, Brian; Xia, Fei; Chi, Ed; Le, Quoc; Zhou, Denny (2022). "Chain-of-Thought Prompting Elicits Reasoning in Large Language Models". Advances in Neural Information Processing Systems: 24824–24837.
  67. Wiggers, Kyle (ngày 14 tháng 12 năm 2024). "'Reasoning' AI models have become a trend, for better or worse". TechCrunch (bằng tiếng Anh). Truy cập ngày 16 tháng 11 năm 2025.
  68. "AI Developers Look Beyond Chain-of-Thought Prompting". IEEE Spectrum (bằng tiếng Anh). ngày 8 tháng 5 năm 2025. Truy cập ngày 16 tháng 11 năm 2025.
  69. "AI Developers Look Beyond Chain-of-Thought Prompting". IEEE Spectrum (bằng tiếng Anh). ngày 8 tháng 5 năm 2025. Truy cập ngày 16 tháng 11 năm 2025.
  70. 1 2 Metz, Cade (ngày 20 tháng 12 năm 2024). "OpenAI Unveils New A.I. That Can 'Reason' Through Math and Science Problems". The New York Times. Truy cập ngày 3 tháng 2 năm 2025.
  71. Gibney, Elizabeth (ngày 30 tháng 1 năm 2025). "China's cheap, open AI model DeepSeek thrills scientists". Nature. Truy cập ngày 3 tháng 2 năm 2025.
  72. Kiros, Ryan; Salakhutdinov, Ruslan; Zemel, Rich (2014). "Multimodal Neural Language Models". Proceedings of the 31st International Conference on Machine Learning: 595–603.
  73. Driess, Danny; Xia, Fei (2023). "PaLM-E: An Embodied Multimodal Language Model". ICML. 202: 8469–8488.
  74. Li, Junnan; Li, Dongxu; Savarese, Silvio; Hoi, Steven (2023). "BLIP-2: Bootstrapping Language-Image Pre-training with Frozen Image Encoders and Large Language Models". ICML. 202: 19730–19742.
  75. Alayrac, Jean-Baptiste; Donahue, Jeff; Luc, Pauline; Miech, Antoine; Barr, Iain; Hasson, Yana; Lenc, Karel; Mensch, Arthur; Millican, Katherine; Reynolds, Malcolm; Ring, Roman; Rutherford, Eliza; Cabi, Serkan; Han, Tengda; Gong, Zhitao (2022). "Flamingo: a Visual Language Model for Few-Shot Learning". Advances in Neural Information Processing Systems. 35: 23716–23736. arXiv:2204.14198.
  76. Finnie-Ansley, James; Denny, Paul; Becker, Brett A.; Luxton-Reilly, Andrew; Prather, James (2022). "The Robots Are Coming: Exploring the Implications of OpenAI Codex on Introductory Programming". Proceedings of the 24th Australasian Computing Education Conference. tr. 10–19. doi:10.1145/3511861.3511863.
  77. Husein, Rasha Ahmad; Aburajouh, Hala; Catal, Cagatay (2025). "Large language models for code completion: A systematic literature review". Computer Standards & Interfaces. 92 103917. doi:10.1016/j.csi.2024.103917.
  78. Lin, Zeming; Akin, Halil; Rao, Roshan; Hie, Brian; Zhu, Zhongkai; Lu, Wenting; Smetanin, Nikita; Verkuil, Robert; Kabeli, Ori; Shmueli, Yaniv; dos Santos Costa, Allan; Fazel-Zarandi, Maryam; Sercu, Tom; Candido, Salvatore; Rives, Alexander (2023). "Evolutionary-scale prediction of atomic-level protein structure with a language model". Science. 379 (6637): 1123–1130. doi:10.1126/science.ade2574.
  79. Hoffmann, Jordan; Borgeaud, Sebastian; Mensch, Arthur; Buchatskaya, Elena; Cai, Trevor; Rutherford, Eliza; Casas, Diego de Las; Hendricks, Lisa Anne; Welbl, Johannes; Clark, Aidan; Hennigan, Tom; Noland, Eric; Millican, Katie; Driessche, George van den; Damoc, Bogdan (2022). "Training Compute-Optimal Large Language Models". Advances in Neural Information Processing Systems: 30016–30030.
  80. Ornes, Stephen (ngày 16 tháng 3 năm 2023). "The Unpredictable Abilities Emerging From Large AI Models". Quanta Magazine (bằng tiếng Anh). Truy cập ngày 13 tháng 3 năm 2026.
  81. Wei, Jason; Tay, Yi; Bommasani, Rishi; Raffel, Colin; Zoph, Barret; Borgeaud, Sebastian; Yogatama, Dani; Bosma, Maarten; Zhou, Denny; Metzler, Donald; Chi, Ed H.; Hashimoto, Tatsunori; Vinyals, Oriol; Liang, Percy; Dean, Jeff; Fedus, William (2022). "Emergent Abilities of Large Language Models". Transactions on Machine Learning Research.
  82. Schaeffer, Rylan; Miranda, Brando; Koyejo, Sanmi (2023). "Are Emergent Abilities of Large Language Models a Mirage?". Advances in Neural Information Processing Systems. arXiv:2304.15004.
  83. Nanda, Neel; Chan, Lawrence; Lieberum, Tom; Smith, Jess; Steinhardt, Jacob (ngày 1 tháng 1 năm 2023). "Progress Measures for Grokking via Mechanistic Interpretability". arXiv:2301.05217 [cs.LG].
  84. Mitchell, Melanie; Krakauer, David C. (2023). "The debate over understanding in AI's large language models". Proceedings of the National Academy of Sciences. 120 (13) e2215907120. arXiv:2210.13966. doi:10.1073/pnas.2215907120.
  85. Ji, Ziwei; Lee, Nayeon; Frieske, Rita; Yu, Tiezheng; Su, Dan; Xu, Yan; Ishii, Etsuko; Bang, Yejin; Dai, Wenliang; Madotto, Andrea; Fung, Pascale (2023). "Survey of Hallucination in Natural Language Generation". ACM Computing Surveys. 55 (12): 1–38. arXiv:2202.03629. doi:10.1145/3571730.
  86. Lỗi chú thích: Thẻ <ref> không hợp lệ; không có nội dung trong ref có tên "jm"
  87. Shannon, Claude E. (1948). "A Mathematical Theory of Communication". Bell System Technical Journal. 27 (3): 379–423. doi:10.1002/j.1538-7305.1948.tb01338.x.
  88. 1 2 Wayne Xin Zhao; Zhou, Kun; Li, Junyi; Tang, Tianyi; Wang, Xiaolei; Hou, Yupeng; Min, Yingqian; Zhang, Beichen; Zhang, Junjie; Dong, Zican; Du, Yifan; Yang, Chen; Chen, Yushuo; Chen, Zhipeng; Jiang, Jinhao; Ren, Ruiyang; Li, Yifan; Tang, Xinyu; Liu, Zikang; Liu, Peiyu; Nie, Jian-Yun; Wen, Ji-Rong (2023). "A Survey of Large Language Models". arXiv:2303.18223 [cs.CL].
  89. Clark, Christopher; Lee, Kenton; Chang, Ming-Wei; Kwiatkowski, Tom; Collins, Michael; Toutanova, Kristina (2019). "BoolQ: Exploring the Surprising Difficulty of Natural Yes/No Questions". ACL: 2924–2936. doi:10.18653/v1/N19-1300.
  90. "Sanitized open-source datasets for natural language and code understanding: how we evaluated our 70B model". imbue.com (bằng tiếng Anh). Lưu trữ bản gốc ngày 26 tháng 7 năm 2024. Truy cập ngày 24 tháng 7 năm 2024.
  91. Lin, Stephanie; Hilton, Jacob; Evans, Owain (2021). "TruthfulQA: Measuring How Models Mimic Human Falsehoods". ACL. arXiv:2109.07958.
  92. Zellers, Rowan; Holtzman, Ari; Bisk, Yonatan; Farhadi, Ali; Choi, Yejin (2019). "HellaSwag: Can a Machine Really Finish Your Sentence?". ACL. arXiv:1905.07830.
  93. "Extracting Training Data from Large Language Models" (PDF). USENIX Security. 2021.
  94. 1 2 Xu, Weijie; Wang, Yiwen; Xue, Chi; Hu, Xiangkun; Fang, Xi; Dong, Guimin; Reddy, Chandan K. (ngày 28 tháng 6 năm 2025). "Quantifying Fairness in LLMs Beyond Tokens: A Semantic and Statistical Perspective". COLM. arXiv:2506.19028.
  95. "Man is to Computer Programmer as Woman is to Homemaker? Debiasing Word Embeddings" (PDF). NeurIPS. 2016.
  96. 1 2 Bender, Emily M.; Gebru, Timnit; McMillan-Major, Margaret (ngày 3 tháng 3 năm 2021). "On the Dangers of Stochastic Parrots: Can Language Models Be Too Big?" (PDF). FAccT. Truy cập ngày 2 tháng 10 năm 2025.
  97. "A Perspectival Mirror of the Elephant". Communications of the ACM (bằng tiếng Anh). ngày 22 tháng 7 năm 2024.
  98. Hofmann, Valentin; Kalluri, Pratyusha Ria; Jurafsky, Dan; King, Sharese (ngày 5 tháng 9 năm 2024). "AI generates covertly racist decisions about people based on their dialect". Nature (bằng tiếng Anh). 633 (8028): 147–154. Bibcode:2024Natur.633..147H. doi:10.1038/s41586-024-07856-5. ISSN 0028-0836. PMC 11374696. PMID 39198640.
  99. Wang, Angelina; Morgenstern, Jamie; Dickerson, John P. (ngày 17 tháng 2 năm 2025). "Large language models that replace human participants can harmfully misportray and flatten identity groups". Nature Machine Intelligence. 7 (3): 400–411. arXiv:2402.01908. doi:10.1038/s42256-025-00986-z.
  100. Cheng, Myra; Durmus, Esin; Jurafsky, Dan (ngày 29 tháng 5 năm 2023). "Marked Personas: Using Natural Language Prompts to Measure Stereotypes in Language Models". ACM. arXiv:2305.18189.
  101. Kotek, Hadas; Dockum, Rikker; Sun, David (ngày 5 tháng 11 năm 2023). "Gender bias and stereotypes in Large Language Models". Proceedings of the ACM Collective Intelligence Conference. New York, NY, USA: Association for Computing Machinery. tr. 12–24. arXiv:2308.14921. doi:10.1145/3582269.3615599. ISBN 979-8-4007-0113-9.
  102. Gao, Bufan; Kreiss, Elisa (ngày 10 tháng 9 năm 2025). "Measuring Bias or Measuring the Task: Understanding the Brittle Nature of LLM Gender Biases". arXiv:2509.04373 [cs.CL].
  103. Choi, Hyeong Kyu; Xu, Weijie; Xue, Chi; Eckman, Stephanie; Reddy, Chandan K. (ngày 27 tháng 9 năm 2024). "Mitigating Selection Bias with Node Pruning and Auxiliary Options". arXiv:2409.18857 [cs.AI].
  104. Zheng, Chujie; Zhou, Hao; Meng, Fandong; Zhou, Jie; Huang, Minlie (ngày 7 tháng 9 năm 2023). "Large Language Models Are Not Robust Multiple Choice Selectors". arXiv:2309.03882 [cs.CL].
  105. Heikkilä, Melissa (ngày 7 tháng 8 năm 2023). "AI language models are rife with different political biases". MIT Technology Review. Truy cập ngày 29 tháng 12 năm 2023.
  106. Amodei, Dario; Olah, Chris; Steinhardt, Jacob; Christiano, Paul; Schulman, John; Mané, Dan (ngày 21 tháng 6 năm 2016). "Concrete Problems in AI Safety". arXiv:1606.06565 [cs.AI].
  107. 1 2 Lỗi chú thích: Thẻ <ref> không hợp lệ; không có nội dung trong ref có tên "bhaa"
  108. Lyons, Jessica (ngày 26 tháng 9 năm 2025). "Prompt injection – and a $5 domain – trick Salesforce Agentforce into leaking sales". The Register. Truy cập ngày 26 tháng 9 năm 2025.
  109. Carlini, Nicholas; Tramèr, Florian; Wallace, Eric (ngày 11 tháng 8 năm 2021). "Extracting Training Data from Large Language Models" (PDF). USENIX Association. Truy cập ngày 2 tháng 10 năm 2025.
  110. Zhao, Yao; Zhang, Yun; Sun, Yong (ngày 7 tháng 6 năm 2023). "The debate over understanding in AI's large language models". Proceedings of the National Academy of Sciences. 120 (13) e2215907120. arXiv:2306.05499. Bibcode:2023PNAS..12015907M. doi:10.1073/pnas.2215907120. PMC 10068812. PMID 36943882.
  111. Buolamwini, Joy; Gebru, Timnit (ngày 1 tháng 1 năm 2018). "Gender Shades: Intersectional Accuracy Disparities in Commercial Gender Classification" (PDF). Proceedings of Machine Learning Research (FAT*). Truy cập ngày 2 tháng 10 năm 2025.
  112. Yang, Kaiqi (ngày 1 tháng 11 năm 2024). "Unpacking Political Bias in Large Language Models: A Cross-Model Comparison on U.S. Politics". arXiv:2412.16746 [cs.CY].
  113. Strubell, Emma; Ganesh, Ananya; McCallum, Andrew (ngày 28 tháng 7 năm 2019). "Energy and Policy Considerations for Deep Learning in NLP" (PDF). ACL Anthology. Truy cập ngày 2 tháng 10 năm 2025.
  114. He, Yuhao; Yang, Li; Qian, Chunlian; Li, Tong; Su, Zhengyuan; Zhang, Qiang; Hou, Xiangqing (ngày 28 tháng 4 năm 2023). "Conversational Agent Interventions for Mental Health Problems: Systematic Review and Meta-analysis of Randomized Controlled Trials". Journal of Medical Internet Research. 25 e43862. doi:10.2196/43862. PMC 10182468. PMID 37115595.
  115. Pauketat, Janet V.T.; Ladak, Ali; Anthis, Jacy Reese (2025). "World-Making for a Future with Sentient AI" (PDF). The British Journal of Social Psychology. 64 (1) e12844. doi:10.1111/bjso.12844. PMID 39737875. Truy cập ngày 2 tháng 10 năm 2025.
  116. Anthis, Jacy Reese; Pauketat, Janet V.T. (2025). "Perceptions of Sentient AI and Other Digital Minds: Evidence from the AI, Morality, and Sentience (AIMS) Survey". Proceedings of the 2025 CHI Conference on Human Factors in Computing Systems. tr. 1–22. arXiv:2407.08867. doi:10.1145/3706598.3713329. ISBN 979-8-4007-1394-1.
  117. Amodei, Dario; Olah, Chris; Steinhardt, Jacob (ngày 17 tháng 6 năm 2016). "Concrete Problems in AI Safety". arXiv:1606.06565 [cs.AI].
  118. Alba, Davey (ngày 1 tháng 5 năm 2023). "AI chatbots have been used to create dozens of news content farms". The Japan Times. Truy cập ngày 18 tháng 6 năm 2023.
  119. "Could chatbots help devise the next pandemic virus?". Science. ngày 14 tháng 6 năm 2023. doi:10.1126/science.adj2463. Lưu trữ bản gốc ngày 18 tháng 6 năm 2023. Truy cập ngày 18 tháng 6 năm 2023.
  120. Kang, Daniel (2023). "Exploiting programmatic behavior of LLMs: Dual-use through standard security attacks". IEEE Security and Privacy Workshops. arXiv:2302.05733.
  121. 1 2 "Russian propaganda may be flooding AI models". The American Sunlight Project (bằng tiếng Anh). ngày 26 tháng 2 năm 2025. Bản gốc lưu trữ ngày 4 tháng 4 năm 2025. Truy cập ngày 11 tháng 4 năm 2025.
  122. Goudarzi, Sara (ngày 26 tháng 3 năm 2025). "Russian networks flood the Internet with propaganda, aiming to corrupt AI chatbots". Bulletin of the Atomic Scientists (bằng tiếng Anh). Truy cập ngày 10 tháng 4 năm 2025.
  123. Wang, Yongge (ngày 20 tháng 6 năm 2024). "Encryption Based Covert Channel for Large Language Models" (PDF). IACR ePrint 2024/586. Lưu trữ (PDF) bản gốc ngày 24 tháng 6 năm 2024. Truy cập ngày 24 tháng 6 năm 2024.
  124. Sharma, Mrinank; Tong, Meg; Korbak, Tomasz (ngày 20 tháng 10 năm 2023). "Towards Understanding Sycophancy in Language Models". arXiv:2310.13548 [cs.CL].
  125. Rrv, Aswin; Tyagi, Nemika (ngày 11 tháng 8 năm 2024). "Chaos with Keywords: Exposing Large Language Models Sycophancy to Misleading Keywords and Evaluating Defense Strategies" (PDF). ACL Anthology. Truy cập ngày 2 tháng 10 năm 2025.
  126. Salvi, Francesco; Horta Ribeiro, Manoel; Gallotti, Riccardo (ngày 19 tháng 5 năm 2025). "On the conversational persuasiveness of GPT-4". Nature Human Behaviour. 9 (8): 1645–1653. doi:10.1038/s41562-025-02194-6. PMC 12367540. PMID 40389594.
  127. Østergaard, Søren Dinesen (ngày 25 tháng 8 năm 2023). "Will Generative Artificial Intelligence Chatbots Generate Delusions in Individuals Prone to Psychosis?". Schizophrenia Bulletin. 49 (6): 1418–1419. doi:10.1093/schbul/sbad128. PMC 10686326. PMID 37625027.
  128. Rosenberg, Josh (ngày 21 tháng 8 năm 2025). "South Park Calls Out ChatGPT and Useless Tech-Bro Sycophants". Esquire. Truy cập ngày 2 tháng 10 năm 2025.
  129. "openai-python/chatml.md at v0.27.6 · openai/openai-python". GitHub (bằng tiếng Anh).
  130. Douglas, Will (ngày 3 tháng 3 năm 2023). "The inside story of how ChatGPT was built from the people who made it". MIT Technology Review. Lưu trữ bản gốc ngày 3 tháng 3 năm 2023. Truy cập ngày 6 tháng 3 năm 2023.
  131. Greshake, Kai; Abdelnabi, Sahar; Mishra, Shailesh; Endres, Christoph; Holz, Thorsten; Fritz, Mario (ngày 1 tháng 2 năm 2023). "Not What You've Signed Up For: Compromising Real-World LLM-Integrated Applications with Indirect Prompt Injection". Proceedings of the 16th ACM Workshop on Artificial Intelligence and Security. tr. 79–90. doi:10.1145/3605764.3623985. ISBN 979-8-4007-0260-0.
  132. Edwards, Benj (ngày 15 tháng 1 năm 2024). "AI poisoning could turn models into destructive "sleeper agents," says Anthropic". Ars Technica (bằng tiếng Anh). Truy cập ngày 19 tháng 7 năm 2025.
  133. "U.S. judge approves $1.5 billion Anthropic copyright settlement with authors". Reuters. ngày 25 tháng 9 năm 2025. Truy cập ngày 26 tháng 9 năm 2025.
  134. "Anthropic reaches $1.5B settlement with authors over AI copyright claims". Associated Press. ngày 25 tháng 9 năm 2025. Truy cập ngày 26 tháng 9 năm 2025.
  135. "Meta fends off authors' U.S. copyright lawsuit over AI". Reuters. ngày 25 tháng 6 năm 2025. Truy cập ngày 26 tháng 6 năm 2025.
  136. "Meta Scores Victory in AI Copyright Case". Wired. ngày 25 tháng 6 năm 2025. Truy cập ngày 26 tháng 6 năm 2025.
  137. "OpenAI defeats news outlets' copyright lawsuit over AI training for now". Reuters. ngày 7 tháng 11 năm 2024. Truy cập ngày 8 tháng 11 năm 2024.
  138. Robison, Kylie (ngày 21 tháng 11 năm 2024). "OpenAI erases evidence in training data lawsuit". The Verge. Truy cập ngày 22 tháng 11 năm 2024.
  139. Peng, Zhencan; Wang, Zhizhi; Deng, Dong (ngày 13 tháng 6 năm 2023). "Near-Duplicate Sequence Search at Scale for Large Language Model Memorization Evaluation" (PDF). Proceedings of the ACM on Management of Data. 1 (2): 1–18. doi:10.1145/3589324. S2CID 259213212. Lưu trữ (PDF) bản gốc ngày 27 tháng 8 năm 2024. Truy cập ngày 20 tháng 1 năm 2024. Trích dẫn Lee và cộng sự năm 2022.
  140. Peng, Wang & Deng 2023, tr. 8.
  141. Council, Stephen (ngày 1 tháng 12 năm 2023). "How Googlers cracked an SF rival's tech model with a single word". SFGate. Lưu trữ bản gốc ngày 16 tháng 12 năm 2023.
  142. "Prepare for truly useful large language models". Nature Biomedical Engineering. 7 (2): 85–86. ngày 7 tháng 3 năm 2023. doi:10.1038/s41551-023-01012-6. PMID 36882584. S2CID 257403466.
  143. Brinkmann, Levin; Baumann, Fabian; Bonnefon, Jean-François; Derex, Maxime; Müller, Thomas F.; Nussberger, Anne-Marie; Czaplicka, Agnieszka; Acerbi, Alberto; Griffiths, Thomas L.; Henrich, Joseph; Leibo, Joel Z.; McElreath, Richard; Oudeyer, Pierre-Yves; Stray, Jonathan; Rahwan, Iyad (ngày 20 tháng 11 năm 2023). "Machine culture". Nature Human Behaviour (bằng tiếng Anh). 7 (11): 1855–1868. arXiv:2311.11388. doi:10.1038/s41562-023-01742-2. ISSN 2397-3374. PMID 37985914.
  144. Niederhoffer, Kate; Kellerman, Gabriella Rosen; Lee, Angela; Liebscher, Alex; Rapuano, Kristina; Hancock, Jeffrey T. (ngày 25 tháng 9 năm 2025). "AI-Generated "Workslop" Is Destroying Productivity". Harvard Business Review (bằng tiếng Anh). Truy cập ngày 22 tháng 9 năm 2025.
  145. Acar, Oguz A.; Gai, Phyliss Jia; Tu, Yanping; Hou, Jiayi (ngày 1 tháng 8 năm 2025). "Research: The Hidden Penalty of Using AI at Work". Harvard Business Review (bằng tiếng Anh). Truy cập ngày 22 tháng 9 năm 2025.
  146. You, Josh (ngày 7 tháng 2 năm 2025). "How much energy does ChatGPT use?". Epoch AI. Truy cập ngày 11 tháng 11 năm 2025.
  147. "Power Hungry: How AI Will Drive Energy Demand". IMF (bằng tiếng Anh). Truy cập ngày 8 tháng 10 năm 2025.
  148. Mehta, Sourabh (ngày 3 tháng 7 năm 2024). "How Much Energy Do LLMs Consume? Unveiling the Power Behind AI". Association of Data Scientists (bằng tiếng Anh). Truy cập ngày 27 tháng 1 năm 2025.
  149. Luccioni, Sasha; Jernite, Yacine; Strubell, Emma (2024). "Power Hungry Processing: Watts Driving the Cost of AI Deployment?". The 2024 ACM Conference on Fairness Accountability and Transparency. tr. 85–99. arXiv:2311.16863. doi:10.1145/3630106.3658542. ISBN 979-8-4007-0450-5.
  150. 1 2 Edwards, Benj (ngày 26 tháng 3 năm 2025). "Open source devs say AI crawlers dominate traffic, forcing blocks on entire countries". Ars Technica. Truy cập ngày 31 tháng 12 năm 2025.
  151. Claburn, Thomas (ngày 18 tháng 3 năm 2025). "AI crawlers haven't learned to play nice with websites". The Register. Truy cập ngày 31 tháng 12 năm 2025.
  152. Belanger, Ashley (ngày 29 tháng 1 năm 2025). "AI haters build tarpits to trap and trick AI scrapers that ignore robots.txt". Ars Technica. Truy cập ngày 31 tháng 12 năm 2025.
  153. Zao-Sanders, Marc (ngày 19 tháng 3 năm 2024). "How People Are Really Using GenAI". Harvard Business Review (bằng tiếng Anh). ISSN 0017-8012. Truy cập ngày 10 tháng 8 năm 2025.
  154. Rousmaniere, Tony; Zhang, Yimeng; Li, Xu; Shah, Siddharth (ngày 21 tháng 7 năm 2025). "Large language models as mental health resources: Patterns of use in the United States". Practice Innovations (bằng tiếng Anh). doi:10.1037/pri0000292. ISSN 2377-8903.
  155. Ji, Shaoxiong; Zhang, Tianlin; Yang, Kailai; Ananiadou, Sophia; Cambria, Erik (ngày 17 tháng 12 năm 2023). "Rethinking Large Language Models in Mental Health Applications". arXiv:2311.11267 [cs.CL].
  156. Moore, Jared; Grabb, Declan; Agnew, William; Klyman, Kevin; Chancellor, Stevie; Ong, Desmond C.; Haber, Nick (ngày 25 tháng 4 năm 2025). "Expressing stigma and inappropriate responses prevents LLMS from safely replacing mental health providers". Proceedings of the 2025 ACM Conference on Fairness, Accountability, and Transparency. tr. 599–627. arXiv:2504.18412. doi:10.1145/3715275.3732039. ISBN 979-8-4007-1482-5.
  157. Grabb, Declan; Lamparth, Max; Vasan, Nina (ngày 14 tháng 8 năm 2024). "Risks from Language Models for Automated Mental Healthcare: Ethics and Structure for Implementation". arXiv:2406.11852 [cs.CY].
  158. McBain, Ryan K.; Cantor, Jonathan H.; Zhang, Li Ang; Baker, Olesya; Zhang, Fang; Halbisen, Alyssa; Kofner, Aaron; Breslau, Joshua; Stein, Bradley; Mehrotra, Ateev; Yu, Hao (ngày 5 tháng 3 năm 2025). "Competency of Large Language Models in Evaluating Appropriate Responses to Suicidal Ideation: Comparative Study". Journal of Medical Internet Research (bằng tiếng Anh). 27 (1) e67891. doi:10.2196/67891. PMC 11928068. PMID 40053817.
  159. Li, Fei-Fei; Etchemendy, John (ngày 22 tháng 5 năm 2024). "No, Today's AI Isn't Sentient. Here's How We Know". Time. Truy cập ngày 22 tháng 5 năm 2024.
  160. Chalmers, David J. (ngày 9 tháng 8 năm 2023). "Could a Large Language Model Be Conscious?". Boston Review.
  161. Thomson, Jonny (ngày 31 tháng 10 năm 2022). "Why don't robots have rights?". Big Think. Lưu trữ bản gốc ngày 13 tháng 9 năm 2024. Truy cập ngày 23 tháng 2 năm 2024.
  162. Kateman, Brian (ngày 24 tháng 7 năm 2023). "AI Should Be Terrified of Humans". Time. Lưu trữ bản gốc ngày 25 tháng 9 năm 2024. Truy cập ngày 23 tháng 2 năm 2024.
  163. Metzinger, Thomas (2021). "Artificial Suffering: An Argument for a Global Moratorium on Synthetic Phenomenology". Journal of Artificial Intelligence and Consciousness. 08: 43–66. doi:10.1142/S270507852150003X. S2CID 233176465.
  164. Tkachenko, Yegor (2024). "Position: Enforced Amnesia as a Way to Mitigate the Potential Risk of Silent Suffering in the Conscious AI". ICML. 235: 48362–48368.
  165. Leith, Sam (ngày 9 tháng 7 năm 2022). "Nick Bostrom: How can we be certain a machine isn't conscious?". The Spectator. Truy cập ngày 22 tháng 9 năm 2025.
  166. Chalmers, David (1995). "Facing up to the problem of consciousness". Journal of Consciousness Studies. 2 (3): 200–219. CiteSeerX 10.1.1.103.8362.
  167. Maruf, Ramishah (ngày 25 tháng 7 năm 2022). "Google fires engineer who contended its AI technology was sentient". CNN. Truy cập ngày 22 tháng 9 năm 2025.