Skip to content

Ngưỡng % nội dung AI cho phép trong luận văn là bao nhiêu?

Không có một ngưỡng % nội dung AI chung áp dụng cho mọi luận văn, khóa luận tại Việt Nam hay quốc tế — khác hẳn với ngưỡng tỷ lệ trùng lặp mà nhiều trường đã quy định cụ thể (thường 20–30%). Lý do cốt lõi: điểm số AI là xác suất ước lượng về đặc điểm thống kê của câu chữ, không phải phép đếm số từ thực sự do AI viết ra. Ngay cả Turnitin — công cụ phổ biến nhất — cũng chủ động từ chối đưa ra một con số "đạt/không đạt". Bài viết này giải thích vì sao ngưỡng AI khác về bản chất so với ngưỡng trùng lặp, cách các công cụ và trường đại học thực sự xử lý con số này, và sinh viên nên đọc chỉ số AI trong báo cáo như thế nào.

Cập nhật: tháng 8/2026 — Biên soạn bởi đội ngũ Kiểm Tra Tài Liệu, Metis JSC

Vì sao không có ngưỡng % nội dung AI chung cho mọi luận văn?

Câu trả lời ngắn: vì AI score đo "văn bản trông giống AI đến mức nào", không đo "AI đã viết bao nhiêu phần trăm bài".

Turnitin nêu rõ trong tài liệu hướng dẫn chính thức: không có một con số nào đúng cho tất cả khi nói đến tỷ lệ AI chấp nhận được — quyết định về liêm chính học thuật cần kết hợp chỉ số AI với ngữ cảnh, yêu cầu đề bài, bản nháp, trích dẫn và đánh giá của giảng viên, vì bản chất chỉ số này mang tính xác suất.

Điều này khác hẳn tỷ lệ trùng lặp, vốn đếm được chính xác bao nhiêu ký tự trùng khớp với nguồn cụ thể nào — một phép đo có thể kiểm chứng lại 1:1. AI score thì không có "nguồn gốc" để đối chiếu; nó chỉ so sánh đặc điểm câu chữ (độ dễ đoán từ, độ đều của câu) với mẫu hình văn bản AI đã học được. Vì vậy đặt một ngưỡng cứng như "trên 30% AI là vi phạm" sẽ trừng phạt nhầm rất nhiều bài người viết thật — đặc biệt văn phong học thuật chuẩn mực vốn dễ bị nhận nhầm, như đã phân tích trong bài AI detector có chính xác không.

Ngưỡng AI khác ngưỡng trùng lặp ở những điểm nào?

Bảng dưới đối chiếu trực tiếp hai loại chỉ số mà sinh viên hay nhầm là "cùng một kiểu con số phần trăm":

Tiêu chíNgưỡng % trùng lặpNgưỡng % nội dung AI
Bản chất phép đoĐếm ký tự/cụm từ khớp với nguồn có sẵnƯớc lượng xác suất dựa trên đặc điểm thống kê câu chữ
Có "bằng chứng gốc" đối chiếu khôngCó — chỉ ra được nguồn trùng cụ thểKhông — không có văn bản gốc để so sánh
Ngưỡng phổ biến tại các trường VNThường 20–30%, có quy định bằng văn bảnHầu như chưa trường nào công bố con số cụ thể
Độ tin cậy khi văn bản ngắnỔn định, không phụ thuộc độ dài nhiềuKém tin cậy dưới 300 từ
Có thể dùng làm bằng chứng kỷ luật duy nhất khôngCó thể, kèm phân loại nguồn trùngKhông nên — cần kết hợp thêm bằng chứng khác

Sự khác biệt then chốt nằm ở dòng cuối: một tỷ lệ trùng lặp 35% có thể tách bạch rõ phần nào là trích dẫn hợp lệ, phần nào là sao chép — quy trình này được mô tả chi tiết ở bài cách đọc báo cáo kiểm tra trùng lặp. Còn một AI score 60% không tách được "60% do AI viết, 40% do người viết" — nó chỉ nói toàn bài có mức độ giống văn AI ở mức đó.

Turnitin xử lý ngưỡng % AI như thế nào trong thực tế?

Turnitin, công cụ AI detection được dùng rộng rãi nhất tại các đại học quốc tế, tự đặt ra một ngưỡng kỹ thuật — nhưng không phải ngưỡng "vi phạm".

Theo tài liệu hướng dẫn của Turnitin, các đoạn có điểm AI trong khoảng 1–19% không được gán số phần trăm cụ thể, mà chỉ hiển thị ký hiệu (*%) kèm cảnh báo độ tin cậy thấp — vì tỷ lệ false positive (báo nhầm bài người viết thành AI) cao hơn hẳn ở vùng điểm số thấp này.

Nói cách khác, ngưỡng 20% mà Turnitin dùng không phải "trên 20% là gian lận", mà là ngưỡng kỹ thuật để quyết định khi nào công cụ đủ tin cậy để hiển thị một con số cụ thể thay vì để trống. Đây là điểm rất nhiều sinh viên hiểu nhầm khi thấy báo cáo ghi "20%" và mặc định coi đó là mốc phân định đạt/không đạt.

Ba nguyên tắc Turnitin khuyến nghị các cơ sở đào tạo áp dụng:

  1. Không dùng điểm AI làm bằng chứng duy nhất để kết luận vi phạm.
  2. Luôn đặt chỉ số AI trong ngữ cảnh: yêu cầu bài tập, bản nháp, lịch sử soạn thảo.
  3. Đánh giá ở cấp độ toàn bài, không kết luận từ vài câu bị gắn cờ riêng lẻ.

Case thực tế: vì sao một đại học Mỹ tắt hẳn công cụ AI detection?

Trường hợp Đại học Vanderbilt (Mỹ) là ví dụ rõ nhất cho thấy các trường đại học thực sự đối xử với ngưỡng AI ra sao trong thực tế, không chỉ trên giấy.

Năm 2023, Vanderbilt University quyết định tắt hoàn toàn tính năng AI writing detection của Turnitin trên toàn trường, với lý do công cụ "chưa đủ độ tin cậy" để sử dụng. Trường quy định rõ: một báo cáo gửi lên Hội đồng Danh dự sinh viên (Undergraduate Honor Council) không được phép chỉ dựa vào điểm số của công cụ phát hiện AI.

Quyết định này không phải cá biệt — nó phản ánh đúng khuyến nghị chính Turnitin đưa ra, và cho thấy ngay cả một công cụ được coi là chuẩn mực ngành cũng có thể bị một trường lớn từ chối áp dụng nếu độ tin cậy chưa đạt yêu cầu tối thiểu để ra quyết định kỷ luật. Đây là dữ kiện quan trọng cho sinh viên: nếu một đại học Mỹ còn không tin số điểm AI đủ để làm bằng chứng, sinh viên càng không nên coi một con số phần trăm cụ thể là "ranh giới an toàn" để né tránh.

Việt Nam có quy định ngưỡng % AI cụ thể không?

Chưa trường nào tại Việt Nam công bố công khai một ngưỡng % AI cụ thể tính đến giữa 2026, và khung pháp lý mới nhất cũng không ấn định con số chung.

Thông tư 49/2026/TT-BGDĐT — văn bản đầu tiên của Việt Nam quy định riêng việc dùng AI trong giáo dục đại học, hiệu lực từ 15/8/2026 — đặt ra nghĩa vụ công bố việc dùng AI khi trường yêu cầu, nhưng giao quyền quyết định ngưỡng cụ thể (được dùng AI đến mức nào, ở khâu nào) cho từng cơ sở đào tạo tự quy định. Cách tiếp cận này khớp với thông lệ quốc tế: không nhà xuất bản hay tổ chức giáo dục lớn nào (Elsevier, UNESCO, các đại học Mỹ) công bố một ngưỡng % số cụ thể — tất cả đều đặt trọng tâm vào nghĩa vụ khai báo và trách nhiệm giải trình của tác giả, thay vì một con số phần trăm máy móc.

Với nghiên cứu sinh làm luận án tiến sĩ, mức độ xem xét càng khắt khe hơn do yêu cầu về đóng góp học thuật độc lập, nhưng vẫn không có ngưỡng số cụ thể được công bố — hội đồng đánh giá chủ yếu qua phỏng vấn bảo vệ và đối chiếu quá trình nghiên cứu.

Vậy sinh viên nên hiểu con số % AI trong báo cáo như thế nào?

Coi đây là tín hiệu để tự kiểm tra, không phải một ngưỡng để "né cho vừa đủ dưới mức an toàn".

Ba cách dùng đúng chỉ số AI trước khi nộp bài:

  1. Xác định đoạn nào bị gắn cờ, không chỉ nhìn con số tổng. Một bài 40% AI có thể tập trung ở đúng phần định nghĩa, tổng quan lý thuyết — nơi văn phong ai viết cũng giống nhau — chứ không phải bằng chứng cả bài do AI viết.
  2. Đối chiếu với quá trình viết thực tế của mình. Nếu bạn tự viết 100% nhưng bị báo AI cao, đây là tín hiệu cần chuẩn bị sẵn lịch sử soạn thảo (Google Docs version history) để giải trình nếu bị hỏi, không phải dấu hiệu bạn đã "vi phạm".
  3. Không cố tình chỉnh sửa để hạ điểm AI xuống dưới một mức tùy ý. Vì không có ngưỡng chính thức, việc này chỉ tốn thời gian mà không đổi được bản chất: nếu nội dung thực sự do AI viết phần lớn không khai báo, đó vẫn là vi phạm liêm chính học thuật dù điểm số hiển thị bao nhiêu.

Tình huống thực tế: sinh viên Việt Nam thường hiểu sai điều gì về ngưỡng AI?

Ba ngộ nhận phổ biến nhất khi trao đổi thực tế với sinh viên, học viên:

  • "Dưới 20% là an toàn." Sai — 20% ở đây là ngưỡng kỹ thuật hiển thị số của Turnitin, không phải ngưỡng vi phạm. Một bài 15% vẫn có thể bị hội đồng đặt câu hỏi nếu đoạn đó nằm đúng ở phần lập luận cốt lõi thay vì phần định nghĩa.
  • "Trường không công bố ngưỡng nghĩa là chưa kiểm tra AI." Sai — theo Thông tư 49/2026/TT-BGDĐT, nghĩa vụ khai báo phát sinh ngay cả khi trường chưa có văn bản ngưỡng cụ thể; nhiều trường vẫn quét AI dù chưa công bố con số áp dụng.
  • "Chạy qua công cụ humanize để đưa điểm AI về 0% là xong." Sai và rủi ro kép — vừa không giải quyết vấn đề liêm chính gốc nếu nội dung thực sự do AI tạo, vừa có thể khiến văn bản trở nên bất thường theo cách khác, dễ bị nghi vấn hơn. Rủi ro của cách làm này được phân tích ở bài AI humanizer là gì.

Checklist trước khi nộp bài: đọc đúng chỉ số AI

  • [ ] Đã đọc báo cáo ở cấp độ từng đoạn, không chỉ nhìn con số phần trăm tổng
  • [ ] Đã đối chiếu các đoạn bị gắn cờ với quá trình viết thực tế của mình
  • [ ] Đã giữ lịch sử soạn thảo (Google Docs/Word version history) làm bằng chứng dự phòng
  • [ ] Đã kiểm tra quy tắc ứng xử AI của trường (nếu có công bố) trước khi nộp
  • [ ] Không dùng công cụ "humanize" để chỉnh điểm AI xuống một mức tùy ý
  • [ ] Với phần dùng AI hỗ trợ hợp lệ (dịch, sửa ngữ pháp), đã khai báo đúng vị trí quy định

Câu hỏi thường gặp

Bao nhiêu % AI thì bị coi là gian lận trong luận văn?

Không có một con số chung. Turnitin và các trường đại học lớn đều khẳng định điểm AI chỉ là tín hiệu tham khảo, không phải ngưỡng đạt/không đạt. Mức độ vi phạm được xác định qua đối chiếu với quá trình viết thực tế và đánh giá của hội đồng, không phải một phép so sánh với con số cố định.

Vì sao Turnitin không hiển thị số phần trăm AI dưới 20%?

Vì tỷ lệ báo nhầm (false positive) cao hơn đáng kể ở vùng điểm số thấp. Turnitin chọn cách ẩn số cụ thể và chỉ hiển thị ký hiệu cảnh báo độ tin cậy thấp, thay vì đưa ra một con số có thể gây hiểu nhầm là ngưỡng chính thức.

Trường tôi chưa công bố ngưỡng AI thì có bị kiểm tra không?

Có thể vẫn bị kiểm tra. Theo Thông tư 49/2026/TT-BGDĐT, nghĩa vụ công bố việc dùng AI phát sinh ngay khi trường yêu cầu, không phụ thuộc việc trường đã ban hành ngưỡng cụ thể bằng văn bản hay chưa — cách an toàn nhất là chủ động khai báo đầy đủ.

Bài tự viết 100% mà bị báo AI cao thì có phải ngưỡng đặt sai không?

Không hẳn — đây là hiện tượng false positive phổ biến với văn phong học thuật chuẩn mực, không liên quan đến việc trường đặt ngưỡng cao hay thấp. Cách xử lý đúng là chuẩn bị bằng chứng quá trình viết, không phải tranh cãi về con số ngưỡng.

Có công cụ AI detection nào công bố một ngưỡng % chính thức không?

Không có công cụ chính thống nào công bố một ngưỡng % được coi là chuẩn ngành. Mỗi công cụ có cách tính và độ nhạy khác nhau; kết quả từ hai công cụ khác nhau trên cùng một bài có thể chênh lệch đáng kể.

Kiểm tra AI và kiểm tra trùng lặp nên dùng ngưỡng khác nhau đúng không?

Đúng. Ngưỡng trùng lặp có thể quy định bằng số cụ thể vì đếm được chính xác phần văn bản khớp nguồn. Ngưỡng AI, do bản chất xác suất, nên được dùng như tín hiệu để trao đổi thêm chứ không phải một con số cắt ngang đạt/không đạt — chi tiết về cơ chế khác biệt giữa hai loại kiểm tra xem tại bài các hệ thống kiểm tra đạo văn, trùng lặp hoạt động như thế nào.

Tóm tắt

  • Không có ngưỡng % nội dung AI chung cho luận văn, khác hẳn ngưỡng trùng lặp vốn thường có con số cụ thể (20–30%) tại nhiều trường.
  • Turnitin ẩn số phần trăm AI dưới 20% vì tỷ lệ false positive cao ở vùng điểm thấp — đây là ngưỡng kỹ thuật, không phải ngưỡng vi phạm.
  • Vanderbilt University tắt hẳn tính năng AI detection của Turnitin năm 2023 vì cho rằng công cụ chưa đủ tin cậy làm bằng chứng kỷ luật.
  • Thông tư 49/2026/TT-BGDĐT của Việt Nam không ấn định ngưỡng % chung, giao quyền quy định cho từng trường — khớp với thông lệ quốc tế.
  • Nên dùng chỉ số AI như tín hiệu tự kiểm tra và chuẩn bị bằng chứng, không phải con số để né tránh cho "vừa đủ dưới ngưỡng".

Nguồn tham khảo

  • Turnitin — tài liệu hướng dẫn chính thức "AI writing detection model" và "AI Writing Report".
  • Vanderbilt University, Generative AI Office — trang hướng dẫn "Academic Integrity and Generative AI" (2023).
  • Thông tư 49/2026/TT-BGDĐT ngày 30/6/2026 của Bộ Giáo dục và Đào tạo, hiệu lực từ 15/8/2026.
  • Liang et al. (2023), Patterns — nghiên cứu về false positive của AI detector với người viết không bản ngữ tiếng Anh.

Biên soạn bởi đội ngũ Kiểm Tra Tài Liệu (Metis JSC) — đơn vị phát triển hệ thống kiểm tra trùng lặp, đạo văn và nội dung AI phục vụ các trường đại học và người học tại Việt Nam.

Bài viết liên quan

Cập nhật gần nhất:

Đăng ký nhận tư vấn kiểm tra đạo văn

Để lại thông tin, đội ngũ Kiểm Tra Tài Liệu sẽ liên hệ tư vấn giải pháp kiểm tra trùng lặp, đạo văn phù hợp cho bạn hoặc đơn vị của bạn.

Hoặc liên hệ nhanh qua Messenger, Zalo hoặc Hotline 0566.685.688.