Công nghệ
Dùng AI Có An Toàn Không? 5 Nguyên Tắc Bảo Mật Dữ Liệu Công Ty Khi Dùng ChatGPT
Hàng triệu nhân viên đang vô tình để lộ dữ liệu công ty qua ChatGPT — 5 nguyên tắc bảo mật giúp bạn dùng AI an toàn mà không đánh đổi thông tin nhạy cảm.

AI Tóm tắt
Bảo mật dữ liệu khi dùng AI là tập hợp các biện pháp kiểm soát, quy trình và công nghệ giúp tổ chức ngăn chặn rò rỉ thông tin nội bộ khi nhân viên sử dụng các công cụ như ChatGPT trong công việc hàng ngày — và nếu công ty bạn chưa có chính sách rõ ràng về điều này, dữ liệu của bạn có thể đang "chảy" ra ngoài ngay lúc này mà không ai hay biết.
Tại Sao Dữ Liệu Công Ty Đang Chảy Vào ChatGPT Mỗi Ngày
ChatGPT đã trở thành công cụ làm việc không thể thiếu với hàng triệu nhân viên toàn cầu. Từ soạn email, phân tích báo cáo đến viết code — tốc độ và tiện lợi của AI khiến người dùng dễ dàng quên mất một câu hỏi quan trọng: thông tin mình vừa paste vào đó sẽ đi đâu? Theo khảo sát Gartner (5–11/2025), hơn 57% nhân viên sử dụng tài khoản GenAI cá nhân cho công việc, trong khi 33% thừa nhận đã nhập thông tin nhạy cảm vào các công cụ chưa được phê duyệt.[3]
Con Số Giật Mình: 34,8% Input Nhân Viên Là Dữ Liệu Nhạy Cảm
Dữ liệu nhạy cảm chiếm tới 34,8% tổng lượng input của nhân viên vào ChatGPT trong quý 4/2025 — tăng gấp hơn 3 lần so với mức 11% năm 2023.[4] Điều đáng lo ngại hơn: 69% tổ chức coi rò rỉ dữ liệu qua AI là mối lo hàng đầu năm 2025, nhưng gần 47% vẫn chưa có biện pháp kiểm soát bảo mật riêng cho AI.[5] Khoảng cách giữa nhận thức và hành động này chính là lỗ hổng mà các sự cố bảo mật đang khai thác.
Vụ Samsung Semiconductor: Bài Học 3 Tuần Và 3 Vụ Rò Rỉ
Tháng 3/2023, Samsung Semiconductor cho phép nhân viên dùng ChatGPT. Chỉ trong vòng 3 tuần, 3 vụ rò rỉ dữ liệu nghiêm trọng đã xảy ra: một kỹ sư paste source code bí mật để nhờ AI debug, một người khác tải nội dung họp nội bộ lên để tóm tắt, và vụ thứ ba liên quan đến dữ liệu phần cứng độc quyền.[28][29] Kết quả: Samsung buộc phải cấm toàn bộ việc sử dụng ChatGPT trên thiết bị công ty.[35] Bài học đắt giá này cho thấy: thiếu chính sách rõ ràng, dù chỉ vài tuần cũng đủ gây hậu quả nghiêm trọng.
5 Rủi Ro Bảo Mật Thực Tế Khi Nhân Viên Paste Dữ Liệu Nội Bộ Vào AI
Không phải mọi rủi ro đều đến từ hacker bên ngoài. Phần lớn sự cố rò rỉ dữ liệu AI xuất phát từ hành vi vô ý của chính nhân viên — những người chỉ đang cố gắng làm việc hiệu quả hơn.
Rủi Ro 1: OpenAI Dùng Hội Thoại Của Bạn Để Huấn Luyện Mô Hình
Với tài khoản Free, Plus và Pro, OpenAI mặc định sử dụng các hội thoại để cải thiện mô hình AI.[17] Điều này có nghĩa là thông tin bạn nhập — kể cả dữ liệu khách hàng, chiến lược kinh doanh hay code nội bộ — có thể được dùng làm dữ liệu huấn luyện. Để tắt tính năng này, vào Profile → Settings → Data Controls → tắt toggle "Improve the model for everyone".[15]
Rủi Ro 2: Tài Khoản Cá Nhân Không Có Lớp Bảo Vệ Doanh Nghiệp
Đáng báo động: 73,8% tài khoản ChatGPT tại nơi làm việc là tài khoản cá nhân, hoàn toàn thiếu các biện pháp kiểm soát bảo mật cấp doanh nghiệp.[1] Tài khoản cá nhân không có SSO (Single Sign-On), không có audit log, không có chính sách xóa dữ liệu tập trung — nghĩa là IT không thể giám sát hay kiểm soát những gì nhân viên đang chia sẻ với AI.
Rủi Ro 3: Thông Tin Đăng Nhập Bị Đánh Cắp Bởi Malware Infostealer
Năm 2025, hơn 225.000 thông tin đăng nhập ChatGPT bị rao bán trên dark web, thu thập bởi malware infostealer LummaC2.[8] Khi tài khoản ChatGPT của nhân viên bị xâm phạm, toàn bộ lịch sử hội thoại — bao gồm mọi dữ liệu nội bộ từng được paste vào — đều có thể rơi vào tay kẻ xấu.[9]
Rủi Ro 4: Vi Phạm Pháp Lý Và Phạt Tiền Từ Cơ Quan Bảo Vệ Dữ Liệu
Tháng 12/2024, cơ quan bảo vệ dữ liệu Italy đã phạt OpenAI €15,6 triệu vì thu thập dữ liệu cá nhân thiếu cơ sở pháp lý.[7] Với các doanh nghiệp hoạt động trong môi trường GDPR, PDPA hay các quy định bảo vệ dữ liệu tương tự, việc nhân viên vô tình đưa dữ liệu khách hàng vào ChatGPT có thể khiến công ty đối mặt với trách nhiệm pháp lý nghiêm trọng.
Rủi Ro 5: Chi Phí Khắc Phục Sự Cố AI Cao Hơn Tấn Công Truyền Thống 38%
Theo IBM Cost of Data Breach Report 2025, sự cố bảo mật liên quan AI gây thiệt hại trung bình $4,88 triệu/vụ, với thời gian khắc phục dài hơn 38% so với tấn công truyền thống.[2] Chi phí này bao gồm điều tra pháp lý, thông báo vi phạm, phạt hành chính và thiệt hại uy tín thương hiệu — những khoản mà không công ty nào muốn chi.
5 Nguyên Tắc Bảo Mật Dữ Liệu Khi Dùng ChatGPT Tại Nơi Làm Việc
Thay vì cấm hoàn toàn như Samsung, các tổ chức tiên tiến đang xây dựng khung quản trị AI cho phép nhân viên tận dụng công cụ này một cách an toàn. Dưới đây là 5 nguyên tắc cốt lõi:
- Phân loại dữ liệu trước khi dùng AI: Xác định rõ loại thông tin nào được phép đưa vào AI (thông tin công khai) và loại nào tuyệt đối không (dữ liệu khách hàng, IP, tài chính nội bộ). Xây dựng ma trận phân loại dữ liệu 3 cấp: Công khai – Nội bộ – Bí mật.[20]
- Triển khai ChatGPT Enterprise hoặc API có hợp đồng DPA: Đây là cách duy nhất để đảm bảo OpenAI không dùng dữ liệu của bạn để huấn luyện mô hình và bạn giữ quyền sở hữu toàn bộ input/output.[10]
- Áp dụng nguyên tắc "ẩn danh hóa trước khi hỏi": Trước khi paste bất kỳ nội dung nào vào AI, thay thế tên người, tên công ty, số tài khoản bằng placeholder như [TÊN_KHÁCH_HÀNG], [MÃ_DỰ_ÁN].[6]
- Triển khai DLP (Data Loss Prevention) cho AI: Sử dụng các giải pháp DLP có khả năng phát hiện và chặn dữ liệu nhạy cảm trước khi chúng được gửi đến các endpoint AI.[21]
- Đào tạo nhân viên định kỳ và xây dựng chính sách AI rõ ràng: Chính sách cần nêu rõ: công cụ AI nào được phép dùng, dữ liệu nào được phép nhập, và quy trình báo cáo khi nghi ngờ rò rỉ.[23]
Checklist Hành Động Ngay: Dành Cho Nhân Viên Và Quản Lý IT
Dưới đây là danh sách hành động cụ thể bạn có thể thực hiện ngay hôm nay, không cần chờ phê duyệt ngân sách hay dự án dài hạn:
Dành cho nhân viên:
- Tắt tính năng huấn luyện mô hình: Settings → Data Controls → tắt "Improve the model for everyone"[14]
- Không bao giờ paste: số CMND/hộ chiếu, thông tin thẻ tín dụng, mật khẩu, source code có nhãn bảo mật, nội dung hợp đồng chưa ký
- Ẩn danh hóa dữ liệu trước khi hỏi AI (thay tên thật bằng placeholder)
- Dùng tài khoản công ty, không dùng email cá nhân để đăng nhập ChatGPT cho công việc
- Bật xác thực 2 yếu tố (2FA) cho tài khoản ChatGPT[18]
Dành cho quản lý IT/Security:
- Kiểm kê toàn bộ công cụ AI đang được dùng trong tổ chức (Shadow AI audit)
- Đánh giá nâng cấp lên ChatGPT Enterprise hoặc ký Data Processing Agreement với OpenAI[16]
- Triển khai DLP có hỗ trợ AI endpoint
- Xây dựng và phổ biến chính sách sử dụng AI trong vòng 30 ngày
- Lên lịch đào tạo nhận thức bảo mật AI cho toàn bộ nhân viên mỗi quý[22]
ChatGPT Enterprise Vs Tài Khoản Cá Nhân: So Sánh Mức Độ Bảo Mật
Sự khác biệt giữa tài khoản cá nhân và ChatGPT Enterprise không chỉ là giá tiền — đó là khoảng cách giữa "hy vọng dữ liệu an toàn" và "có bằng chứng pháp lý rằng dữ liệu được bảo vệ".
ChatGPT Enterprise mã hóa dữ liệu bằng TLS 1.2+ khi truyền tải và AES-256 khi lưu trữ; tổ chức giữ quyền sở hữu toàn bộ input và output, và OpenAI cam kết không dùng dữ liệu này để huấn luyện mô hình.[10]
- Huấn luyện mô hình: Tài khoản cá nhân — mặc định BẬT (phải tự tắt thủ công); Enterprise — mặc định TẮT, không dùng dữ liệu khách hàng
- Mã hóa dữ liệu: Tài khoản cá nhân — có mã hóa cơ bản; Enterprise — TLS 1.2+ và AES-256
- Quyền sở hữu dữ liệu: Tài khoản cá nhân — OpenAI có quyền xử lý; Enterprise — tổ chức giữ toàn quyền
- Audit log & giám sát: Tài khoản cá nhân — không có; Enterprise — có dashboard quản trị tập trung
- SSO & quản lý người dùng: Tài khoản cá nhân — không có; Enterprise — hỗ trợ SSO và SCIM
- Tuân thủ pháp lý: Tài khoản cá nhân — rủi ro cao với GDPR/PDPA; Enterprise — có Data Processing Agreement (DPA)[16]
Nếu ngân sách chưa cho phép nâng cấp ngay lên Enterprise, bước tối thiểu là tắt tính năng huấn luyện mô hình trên tất cả tài khoản cá nhân của nhân viên và ban hành chính sách phân loại dữ liệu rõ ràng. Bảo mật AI không phải là đích đến một lần — đó là hành trình liên tục đòi hỏi cả công nghệ lẫn văn hóa tổ chức cùng thay đổi.[25]
Nguồn tham khảo
- Is ChatGPT Safe for Business in 2026? The Real Risks Start Before the Prompt | Metomic
- ChatGPT Data Security: Preventing Proprietary Data Leaks | IntuitionLabs
- 77% of Employees Leak Data via ChatGPT, Report Finds
- ChatGPT Sensitive Data Statistics: What Employees Share (2026)
- A 2026 Guide to ChatGPT Risks | Concentric AI
- ChatGPT Data Leakage: How Employees Accidentally Expose Proprietary Data - centrexIT Blog
- ChatGPT Data Security & Privacy: The Complete Guide for Users and Enterprises - Captain Compliance
- ChatGPT Security Risks in Enterprise: 2026 Guide to Data Leaks, Breaches & Prevention
- ChatGPT Security Risk: 5 Threats and How to Mitigate Them | Teleskope Blog
- Enterprise privacy at OpenAI | OpenAI
- GPT-5 Training Data Opt-Out: How to Control Your Data and Prevent Model Training | Secure Privacy Blog
- How to Stop AI from Training on Your Data: The 2026 Privacy Guide | Fello AI
- Privacy policy | OpenAI
- What if I want to keep my history on but disable model training? | OpenAI Help Center
- Data Controls FAQ | OpenAI Help Center
- Business data privacy, security, and compliance | OpenAI
- How your data is used to improve model performance | OpenAI
- How to Opt Out of ChatGPT Training on Your Data (OpenAI Guide) — Priwall by mePrism
- Keep your ChatGPT data private by opting out of training — here's how
- AI Security Best Practices: The Complete Guide | Cyberhaven
- Enterprise AI Security Best Practices | ThreatLens
- AI Security Best Practices: Building a Foundation for Responsible Innovation
- AI Data Security in the Workplace: Best Practices for Employees | Microsoft
- Security Considerations for Multi-agent Systems
- Top 4 data security best practices for the AI-enabled enterprise | Cybersecurity Dive
- Privacy in the Age of AI: A Taxonomy of Data Risks
- Securing Dual-Use Pathogen Data of Concern
- Samsung ChatGPT Data Leak (2023)
- Samsung Bans ChatGPT Among Employees After Sensitive Code Leak
- Samsung employees allegedly leak data via ChatGPT
- The Samsung Incident: What Happened When Engineers Pasted
- Incident 768: ChatGPT Reportedly Implicated in Samsung Data Leak of Source Code and Meeting Notes
- Samsung employees leaked corporate data in ChatGPT: report | CIO Dive
- Samsung's ChatGPT Ban: Source Code Leak Lessons
- Samsung bans use of generative AI tools like ChatGPT after April internal data leak | TechCrunch
- Samsung workers made a major error by using ChatGPT | TechRadar
Câu hỏi thường gặp
Dùng ChatGPT có thể gây rủi ro bảo mật nghiêm trọng nếu không có chính sách kiểm soát rõ ràng. Với tài khoản cá nhân (Free, Plus, Pro), OpenAI mặc định dùng hội thoại của bạn để huấn luyện mô hình, nghĩa là dữ liệu khách hàng, chiến lược kinh doanh hay code nội bộ bạn paste vào đều có thể bị xử lý bên ngoài. Để an toàn hơn, doanh nghiệp nên nâng cấp lên ChatGPT Enterprise hoặc ít nhất tắt tính năng huấn luyện mô hình và ban hành chính sách phân loại dữ liệu rõ ràng.



