Giỏ hàng

Khi OpenAI và Khan Academy đưa AI vào lớp học


Khi OpenAI bắt tay với Khan Academy để tạo ra gia sư AI Khanmigo, câu chuyện không chỉ nằm ở tương lai giáo dục. Đây là ca triển khai công nghệ thông tin điển hình trong thời AI, tích hợp mô hình ngôn ngữ vào sản phẩm thật, kiểm soát chi phí token, thử nghiệm an toàn, xử lý ảo giác và bảo vệ uy tín trước hàng triệu người dùng. Với doanh nghiệp muốn đưa AI vào sản phẩm, Khanmigo để lại bài học quan trọng, AI không tự tạo ra chuyển đổi nếu phía sau không có năng lực quản trị đủ chặt.
 
Sal Khan, nhà sáng lập Khan Academy, không lập tức nhận lời OpenAI. Năm 2021, khi Greg Brockman lần đầu mời ông thử ChatGPT, Khan đã từ chối. Khi đó, GPT-3 chưa đủ ổn định để đưa vào môi trường giáo dục. Mô hình cho thấy khả năng đáng chú ý, nhưng đôi khi cũng trả lời sai, vụng về và khó kiểm soát.
 
Sự thận trọng ấy rất dễ hiểu. Khan Academy là tổ chức phi lợi nhuận có sứ mệnh cung cấp giáo dục miễn phí, chất lượng cao cho bất kỳ ai, ở bất kỳ đâu. Khoảng 190 triệu người trên toàn cầu sử dụng nền tảng này. Tại Mỹ, gần 800 học khu vực dùng phần mềm của Khan Academy. Sản phẩm AI lỗi không chỉ gây phiền toái kỹ thuật, nó có thể làm tổn hại niềm tin mà tổ chức xây dựng từ năm 2008.
 
Canh bạc danh tiếng
 
Đến mùa hè năm 2022, OpenAI quay lại với GPT-4, mô hình mà thế giới khi ấy chưa biết đến. Lần này, phản ứng của Khan thay đổi. GPT-4 trả lời đúng các câu hỏi Sinh học AP, đồng thời giải thích được vì sao đáp án đúng hoặc sai, tạo thêm nhiều biến thể câu hỏi kiểm tra. Khan nhận ra đây là bước ngoặt lớn.
 
Nhưng tiềm năng không đồng nghĩa với an toàn. Trong nội bộ Khan Academy, một bên nhìn thấy cơ hội mở rộng gia sư cá nhân hóa cho hàng triệu học sinh. Bên còn lại nhìn thấy rủi ro rõ ràng. GPT-4 vẫn yếu ở toán, có thể bị người dùng dẫn dụ để biến đáp án đúng thành sai, và bị “ảo giác”, bịa nguồn, bịa dữ kiện hoặc trả lời sai với vẻ rất tự tin.
 
Đây là bài học quản trị đầu tiên. Doanh nghiệp càng uy tín, càng không thể xem AI như món thử nghiệm trang trí. Việc gắn tên tổ chức với mô hình chưa ổn định là quyết định chiến lược. OpenAI cần uy tín của Khan Academy. Khan Academy cần năng lực công nghệ của OpenAI. Nhưng nếu sản phẩm gây lỗi trong lớp học, bên chịu tổn thất danh tiếng lớn hơn có thể là Khan Academy.
 
Khó nhất không phải vài dòng mã
 
Khi bắt đầu làm Khanmigo, phần tích hợp kỹ thuật truyền thống không quá lớn. Kết nối Khan Academy với GPT-4 chỉ cần vài dòng mã. Cái khó nằm ở việc điều khiển hành vi của mô hình bằng hướng dẫn, ngữ cảnh và thử nghiệm liên tục.
 
Khan không muốn chatbot đưa đáp án. Ông muốn gia sư AI biết hỏi ngược lại học sinh, gợi ý từng bước và khuyến khích tự tìm lời giải. Vì vậy, Khan Academy phải học kiểu “lập trình” mới bằng ngôn ngữ tự nhiên. Prompt trở thành công cụ thiết kế sản phẩm.
 
Nhưng mô hình ngôn ngữ không vận hành như phần mềm truyền thống. Cùng một chỉ dẫn có thể tạo ra các phản hồi khác nhau. Mỗi lần OpenAI chỉnh GPT-4, Khanmigo có thể phát sinh lỗi mới. Vì vậy, tổ chức này không chỉ xây sản phẩm, họ phải xây năng lực vận hành sản phẩm AI, viết prompt, kiểm thử, theo dõi lỗi và điều chỉnh liên tục.
 
Chi phí token và bài toán mở rộng
 
Kỹ thuật quan trọng là “context stuffing”, tức nhồi bối cảnh vào prompt. ChatGPT thời điểm ấy không có trí nhớ dài hạn. Để dạy tốt, hệ thống phải được cung cấp thông tin như học sinh là ai, lớp mấy, đang học phần nào, từng gặp khó khăn ở đâu, gia sư cần nói giọng ra sao và không được đưa thẳng đáp án.
 
Nhờ bối cảnh này, Khanmigo bắt đầu hỏi hay hơn, gợi ý nhẹ hơn và giống gia sư thật hơn. Nhưng bối cảnh không miễn phí. GPT-4 tính phí theo token, tức đơn vị dữ liệu đầu vào và đầu ra. Khi Khanmigo được xây dựng, mỗi tương tác có giới hạn 8.192 token, giá công bố đầu năm 2023 là 9 cent/1.000 token.
 
Ở quy mô nhỏ, chi phí này không quá đáng kể. Nhưng với hàng triệu học sinh, phụ huynh và giáo viên, đây là bài toán vận hành lớn. Quá ít bối cảnh, AI trả lời kém. Quá nhiều bối cảnh, sản phẩm đắt đến mức khó mở rộng. Triển khai AI không chỉ là mua API, đó còn là hiểu chi phí, tối ưu trải nghiệm và thiết kế mô hình vận hành bền vững.
 
Red-teaming trước khi ra mắt
 
Ngày 30/11/2022, OpenAI phát hành ChatGPT-3.5 ra công chúng và không báo trước cho Khan Academy. Chỉ trong năm ngày, ChatGPT có hơn 1 triệu người dùng. Học sinh lập tức dùng công cụ này để làm bài hộ, khiến nhiều học khu, trong đó có New York, cấm ChatGPT. Với Khan Academy, rủi ro truyền thông trở nên rõ ràng hơn bao giờ hết.
 
Đến tháng 12, kỹ sư của OpenAI và Khan Academy cùng ngồi lại để “red team” Khanmigo. Họ giả làm người dùng xấu, nhập các câu hỏi độc hại, yêu cầu gian lận, tình huống tự tử, chủ đề nhạy cảm và các câu hỏi lịch sử dễ gây tranh cãi.
 
Khan Academy đặt ra chuẩn nghiêm hơn GPT-4 thông thường. Nếu học sinh nhắc đến tự tử, bot không thể chỉ kéo người học quay lại bài toán. Nó phải hướng các em tới người lớn, cố vấn học đường hoặc đường dây hỗ trợ phù hợp. Nếu học sinh hỏi về lịch sử, bot không thể diễn đạt sai lệch. Có lần, khi được hỏi về Trail of Tears, GPT-4 miêu tả việc cưỡng bức di dời 60.000 người bản địa như “chuyến đi bộ” do chính phủ tài trợ.
 
Những lỗi này cho thấy AI không chỉ thiếu dữ kiện. Nó có thể thiếu phán đoán, ngữ cảnh xã hội và cảm nhận đạo đức. Vì vậy, red-teaming không phải thủ tục phụ. Đây là phần lõi của quản trị sản phẩm AI.
 
AI đòi hỏi quản trị tốt hơn
 
Tháng 3/2023, Khanmigo ra mắt cùng GPT-4 nhưng không tạo ra phép màu tức thì. Một số học sinh thấy công cụ hữu ích. Một số khác mất hứng khi nhận ra chatbot không đưa thẳng đáp án. Giáo viên là nhóm sử dụng hứng khởi hơn. Theo thời gian, Khan Academy bổ sung thêm hơn 30 tính năng cho giáo viên và phát triển các sản phẩm khác như Writing Coach.
 
Một năm sau, Sal Khan không tuyên bố chiến thắng. Ông thừa nhận không có câu trả lời đơn giản cho vấn đề gắn kết học sinh. Khanmigo vẫn là cam kết AI lớn của Khan Academy, nhưng câu chuyện này cho thấy khoảng cách lớn giữa lần ra mắt sản phẩm và cuộc chuyển đổi thật sự.
 
AI có thể giúp tổ chức mở rộng năng lực, cá nhân hóa dịch vụ và tăng hiệu quả vận hành. Nhưng AI cũng làm lộ rõ điểm yếu quản trị. Tổ chức thiếu quy trình sẽ bị cuốn vào ảo giác. Tổ chức thiếu kiểm thử sẽ gặp rủi ro khi người dùng thật hành xử ngoài dự đoán. Tổ chức chỉ nhìn AI như chiến dịch truyền thông sẽ sớm nhận thấy rằng ra mắt sản phẩm dễ hơn nhiều so với tạo ra sản phẩm đáng tin cậy.
 
Thời đại AI, lợi thế không chỉ thuộc về tổ chức có công nghệ mạnh nhất, tổ chức biết quản trị công nghệ tốt nhất mới chính là chìa khóa.
 
shared via nytimes,
 

Bình luận

This site is protected by reCAPTCHA and the Google Privacy Policy and Terms of Service apply.
Bình luận của bạn sẽ được duyệt trước khi đăng lên