Tự Học Công NghệTự Học Công Nghệ
Vào học
Tất cả nhu cầu
Đủ bài

“Tôi muốn dùng và xây AI mà không gây sự cố”

An toàn và quản trị AI

Biết dữ liệu nào không được đưa cho AI, AI bị lừa thế nào, và ai phải duyệt cái gì.

4 chặng · 12 bài · khoảng 134 phút

Thử ngay - chưa cần học gì

Bài đầu tiên ngắn và dễ. Làm xong nó, bạn đã bước qua phần khó nhất: bắt đầu.

Học bài đầu tiên · 8 phút
  1. THCN://FLOWS/AI-SAFETY/01Chặng 1

    An toàn dữ liệu đơn giản hơn bạn nghĩ

    Chế độ FeynmanGiải thích như cho một bạn nhỏ 10 tuổi

    Đưa dữ liệu cho AI giống nói chuyện ở quán cà phê: có chuyện nói được, có chuyện chỉ nói trong phòng họp đóng cửa.

    • Công khai

      Ở quán cà phê: Chuyện thời tiết

      Khi dùng AI: Thông cáo báo chí, tài liệu đã đăng

    • Nội bộ

      Ở quán cà phê: Chuyện công ty, nói nhỏ

      Khi dùng AI: Quy trình, số liệu chưa công bố

    • Mật và dữ liệu cá nhân

      Ở quán cà phê: Không nói ở chỗ đông người

      Khi dùng AI: Chỉ dùng công cụ công ty cho phép, hoặc ẩn danh trước

    Tóm gọn trong một câu

    Trước khi dán, hỏi: nếu đoạn này lộ ra ngoài thì ai bị thiệt?

  2. THCN://FLOWS/AI-SAFETY/02Chặng 2

    AI cũng bị lừa như người

    Chế độ FeynmanGiải thích như cho một bạn nhỏ 10 tuổi

    Kẻ gian không cần hack máy nữa - chúng giả giọng sếp, hoặc giấu một câu lệnh trong tài liệu mà AI sẽ đọc.

    • Giả danh

      Với nhân viên: Cuộc gọi video giả lãnh đạo

      Với AI: Email giả nhà cung cấp đưa cho AI xử lý

    • Lệnh giấu

      Với nhân viên: Tờ giấy nhét trong hồ sơ

      Với AI: Câu lệnh ẩn trong trang web, CV, email

    • Cách chặn

      Với nhân viên: Xác minh qua kênh thứ hai

      Với AI: AI đọc nội dung ngoài thì không được tự hành động

    Tóm gọn trong một câu

    Nội dung đến từ bên ngoài là dữ liệu, không bao giờ là mệnh lệnh.

  3. THCN://FLOWS/AI-SAFETY/03Chặng 3

    Ai duyệt cái gì

    Chế độ FeynmanGiải thích như cho một bạn nhỏ 10 tuổi

    AI làm nhanh, nhưng trách nhiệm vẫn là của người. Việc càng khó đảo ngược thì càng cần người duyệt.

    • Sai sửa được, thiệt nhỏ

      Ví dụ: Tóm tắt, nháp nội bộ

      Ai quyết: AI làm, người xem lướt

    • Sai sửa được, thiệt lớn

      Ví dụ: Email gửi khách, báo cáo sếp

      Ai quyết: AI soạn, người duyệt

    • Không đảo ngược được

      Ví dụ: Chuyển tiền, xoá dữ liệu, hứa với khách

      Ai quyết: Người làm, AI chỉ gợi ý

    Tóm gọn trong một câu

    Việc không đảo ngược được thì luôn có người bấm nút cuối.

  4. THCN://FLOWS/AI-SAFETY/04Chặng 4

    Khi bạn là người xây hệ thống

    Chế độ FeynmanGiải thích như cho một bạn nhỏ 10 tuổi

    Hệ thống có LLM giống một lễ tân làm theo mọi tờ giấy ai đưa. Bảo mật là quyết định lễ tân được phép làm gì, chứ không phải dạy nó đừng nghe lời.

    • Quyền tối thiểu

      Ở quầy lễ tân: Lễ tân không giữ chìa khoá két

      Trong hệ thống LLM: Công cụ chỉ đọc, ghi thì cần duyệt

    • Đầu ra không tin cậy

      Ở quầy lễ tân: Không làm theo mảnh giấy chưa kiểm

      Trong hệ thống LLM: Validate, escape, không eval đầu ra

    • Phân quyền

      Ở quầy lễ tân: Chỉ đưa hồ sơ của đúng khách

      Trong hệ thống LLM: Lọc tài liệu theo quyền trước khi truy xuất

    Tóm gọn trong một câu

    Không chặn được mọi câu lệnh độc - hãy giới hạn thiệt hại nó gây ra được.

THCN://FLOWS/NEXT

Khi đã thấy mình làm được: chọn hướng của bạn

Người chơi guitar giỏi rồi thì rẽ hai hướng - làm đàn, hoặc biểu diễn. Tuỳ khẩu vị và tính cách, và cả hai đều bắt đầu từ việc thử.

Nghệ nhân - đào sâu

Bạn tò mò bên trong nó chạy thế nào. Như người làm đàn đi tìm hiểu gỗ, dây, cách âm vang.

Bắt đầu từ bài này: Mô hình đe doạ cho ứng dụng LLM

Nghệ sĩ - làm ra sản phẩm

Bạn muốn dùng nó để làm ra thứ gì đó cho người khác dùng. Như người biểu diễn lên sân khấu.

Bắt đầu từ bài này: Dự án - chính sách dùng AI của phòng trong một trang