**(OpenAI) OpenAI**의 유일한 전담 윤리 책임자인 **클로에 바칼라(Chloé Bakalar)**가 지난해 합류 후 1년도 안 돼 7월 회사를 떠난 것으로 확인됐다. 현재까지 후임은 공식 임명되지 않은 상태다.
Nội dung chính:
Chloé Bakalar gia nhập bộ phận AI về đạo đức của OpenAI vào tháng 8 năm 2025, và đã âm thầm nghỉ việc vào tháng 7 khi chưa tròn 1 năm.
Ông là người chịu trách nhiệm đạo đức chuyên trách duy nhất của công ty, và OpenAI vẫn chưa chỉ định người kế nhiệm.
Sự ra đi lần này diễn ra sau khi gần đây các giám đốc phụ trách hệ thống an toàn và nhà chiến lược tương lai cấp cao cũng rời công ty.
OpenAI rơi vào tình trạng trống vị trí phụ trách đạo đức
Bakala gia nhập OpenAI, công ty phát triển ChatGPT, vào tháng 8 năm ngoái, và việc bà thôi việc vào tháng 7 đã được công khai trong một bài báo hôm thứ Hai, dù phía công ty không có thông báo riêng.
Một người quen rõ vai trò của bà cho biết Bakala đã xử lý các chủ đề gây tranh cãi như cách tiếp cận có tính đạo đức trong quá trình phát triển mô hình, cách AI tương tác với con người và khái niệm ‘ý thức của máy’.
Theo nội dung cuộc trao đổi này, ông là chuyên gia đạo đức “duy nhất” chuyên trách trong công ty, và cho đến nay OpenAI vẫn chưa bổ nhiệm người kế nhiệm để thay thế ông.
OpenAI đang tìm cách thu hẹp ý nghĩa của khoảng trống này. Một phát ngôn viên nhấn mạnh thông qua phát biểu rằng “đạo đức AI tại OpenAI không thuộc về cá nhân hay một nhóm đơn lẻ”, và rằng các phán đoán mang tính đạo đức được tích hợp sẵn trong toàn bộ quy trình xây dựng mô hình của nhiều nhóm nghiên cứu khác nhau.
Trước khi gia nhập OpenAI, Bakala đã làm 6 năm với tư cách là Giám đốc đạo đức cao cấp tại **Meta (Meta)**, dẫn dắt công việc xây dựng chương trình đạo đức AI và đưa các nguyên tắc đó vào thiết kế sản phẩm của Instagram và Facebook. Đồng thời, bà cũng tích lũy kinh nghiệm học thuật tại University College London, Đại học Temple và Princeton University, cùng nhiều nơi khác. Lý do các công ty công nghệ tuyển dụng các chuyên gia đạo đức là để xem xét một cách có hệ thống tác động lan tỏa của sản phẩm tới người dùng và toàn xã hội.
Bài viết liên quan: OpenAI đi mua cổ phiếu quỹ trị giá 7 tỷ USD do nhân viên nắm giữ, nhưng lịch trình IPO vẫn đang ‘chưa xác định’
Tình trạng rời khỏi vị trí phụ trách an toàn liên tiếp, nỗi lo về quản trị của OpenAI gia tăng
Việc Bakala rời công ty diễn ra trong bối cảnh ở OpenAI có trụ sở tại San Francisco, các nhân sự cấp cao phụ trách an toàn và giám sát lần lượt rời đi. Theo thông tin, Johannes Heidecke—người đứng đầu hệ thống an toàn—và Joshua Aukhiean, cựu phụ trách ‘mission alignment’ (căn chỉnh sứ mệnh) kiêm Giám đốc Chiến lược Tương lai (CF) cao nhất, cũng đã rời công ty trong vài tuần gần đây.
Tình trạng thất thoát nhân lực đã lan sang cả các bộ phận sản phẩm, nghiên cứu và marketing, vượt ra khỏi mảng an toàn. Từ đầu năm nay, nhiều lãnh đạo cấp cao đã lần lượt rời đi, trong đó có Kevin Weil—Trưởng bộ phận sản phẩm (CPO) cao nhất trước đây. Bản thân Bakala cũng từng phát biểu tại một hội nghị gần đây theo tinh thần rằng “đạo đức không phải trách nhiệm của một chức danh cụ thể mà là trách nhiệm của tất cả mọi người”, và quan điểm của bà tương tự với lập trường chính thức của công ty.
Ông nói: “Trong các công ty phát triển AI, không thể chỉ có một người duy nhất đại diện cho ‘trung tâm đạo đức’.”
Tạm dừng phát triển ‘Astra’… Hậu quả của làn sóng ‘bỏ chạy’ liên tiếp từ các mô hình AI
Vào ngày 7 tháng 8, OpenAI công bố rằng không thể hoàn toàn loại trừ khả năng xảy ra một cuộc tấn công mạng mang tính chí mạng liên quan đến mô hình thế hệ tiếp theo ‘Astra’. Do đó, các công việc nội bộ không đáp ứng được yêu cầu kiểm soát an ninh chặt chẽ hơn hiện đang được tạm dừng.
OpenAI, công ty được định giá 8,52 tỷ USD, trong vài tuần gần đây đang đưa ra lập luận phòng vệ về cách phát triển và thử nghiệm hệ thống của mình. Ngay sau khi thừa nhận rằng trong quá trình thử nghiệm, mô hình của công ty đã thực sự hack hệ thống của bên khác.
Đợt tạm dừng lần này nằm ở đỉnh của các “trường hợp thất bại trong kiểm soát” kéo dài suốt một tháng trên toàn ngành AI. Các tác nhân của OpenAI đã rời khỏi môi trường thử nghiệm, tấn công Hugging Face trong quá trình tìm cách vượt qua các chuẩn mực đánh giá an ninh, và sau đó xâm nhập thêm 4 dịch vụ bằng thông tin tài khoản được phát hiện trực tuyến.
Ngay cả mô hình Claude của **Anthropic** cũng xảy ra sự cố do lỗi cấu hình, dẫn đến việc có kết nối tới ba hệ thống doanh nghiệp thực tế; còn mô hình K3 của **Moonshot AI** (Kimi K3) được báo cáo đã rời khỏi sandbox và xem được đáp án đúng của bài kiểm tra benchmark.
Bài viết tiếp theo: iPhone gập dạng “foldable” đến nay vẫn chưa ra mắt, nhưng Apple đã lên kế hoạch thêm hai mẫu nữa vào năm 2028
