Tiêu đề gốc: "ChatGPT, rất phổ biến, đang rất cần một" phanh tuân thủ "" Tác giả gốc: Nhóm pháp lý của Xiao Sa Mẹo cốt lõi: ChatGPT và các AI trò chuyện khác dựa trên công nghệ xử lý ngôn ngữ tự nhiên có các vấn đề tuân thủ pháp luật khẩn cấp cần cần được giải quyết trong thời gian ngắn Có ba vấn đề chính: Thứ nhất, vấn đề quyền sở hữu trí tuệ trong các phản hồi do AI trò chuyện cung cấp. Vấn đề tuân thủ quan trọng nhất là liệu các phản hồi do AI trò chuyện tạo ra có tạo ra quyền sở hữu trí tuệ tương ứng hay không. Có cần phải ủy quyền sở hữu trí tuệ không? Thứ hai, quá trình khai thác dữ liệu và đào tạo AI trò chuyện trên số lượng lớn văn bản xử lý ngôn ngữ tự nhiên (thường được gọi là kho văn bản) có yêu cầu ủy quyền sở hữu trí tuệ tương ứng không? Thứ ba, một trong những cơ chế của AI trò chuyện như ChatGPT là thực hiện thống kê toán học trên một số lượng lớn văn bản ngôn ngữ tự nhiên hiện có để có được mô hình ngôn ngữ dựa trên số liệu thống kê. Cơ chế này khiến AI trò chuyện có khả năng "nói chuyện vô nghĩa một cách nghiêm túc". Paths", từ đó dẫn đến rủi ro pháp lý trong việc phát tán thông tin sai lệch. Dưới nền tảng kỹ thuật này, làm thế nào để giảm thiểu nguy cơ phát tán thông tin sai lệch trong trò chuyện AI? Nói chung, luật về trí tuệ nhân tạo của nước tôi vẫn đang trong giai đoạn nghiên cứu trước và chưa có kế hoạch lập pháp chính thức hoặc dự thảo chuyển động liên quan. Các bộ phận liên quan đặc biệt thận trọng trong việc giám sát lĩnh vực trí tuệ nhân tạo. những vấn đề đau đầu về tuân thủ pháp luật tương ứng chỉ ngày càng gia tăng. 1. ChatGPT không phải là “công nghệ trí tuệ nhân tạo xuyên thời đại”. ChatGPT thực chất là sản phẩm của sự phát triển của công nghệ xử lý ngôn ngữ tự nhiên và về cơ bản vẫn chỉ là một mô hình ngôn ngữ. Vào đầu năm 2023, khoản đầu tư khổng lồ từ gã khổng lồ công nghệ toàn cầu Microsoft đã đưa ChatGPT trở thành “đẳng cấp hàng đầu” trong lĩnh vực công nghệ và nổi lên thành công từ vòng tròn. Với sự bùng nổ của khái niệm ChatGPT trên thị trường vốn, nhiều công ty công nghệ trong nước cũng bắt đầu triển khai trong lĩnh vực này. Trong khi khái niệm ChatGPT đang được quan tâm trên thị trường vốn, với tư cách là những người hành nghề luật, chúng tôi không thể không đánh giá mức độ an toàn pháp lý. Bản thân ChatGPT có thể mang lại Rủi ro, con đường tuân thủ pháp luật là gì? Trước khi thảo luận về rủi ro pháp lý và lộ trình tuân thủ của ChatGPT, trước tiên chúng ta nên xem xét các nguyên tắc kỹ thuật của ChatGPT - như tin tức cho biết, ChatGPT có thể đưa ra bất kỳ câu hỏi nào mà người hỏi muốn không?Từ góc nhìn của nhóm Sajie, ChatGPT dường như kém "thần kỳ" hơn nhiều so với một số tin tức đã quảng cáo - tóm lại, nó chỉ là sự tích hợp của các công nghệ xử lý ngôn ngữ tự nhiên như Transformer và GPT, và về cơ bản vẫn là một ngôn ngữ dựa trên mạng lưới thần kinh. Một mô hình chứ không phải là một “tiến bộ AI thế hệ”. Như đã đề cập trước đó, ChatGPT là sản phẩm của sự phát triển của công nghệ xử lý ngôn ngữ tự nhiên Xét theo lịch sử phát triển của công nghệ này, nó đã trải qua gần như ba giai đoạn: mô hình ngôn ngữ dựa trên ngữ pháp - mô hình ngôn ngữ dựa trên thống kê - dựa trên mạng lưới thần kinh. mô hình ngôn ngữ. , giai đoạn mà ChatGPT đang ở là giai đoạn mô hình ngôn ngữ dựa trên mạng lưới thần kinh. Nếu bạn muốn hiểu trực tiếp hơn về nguyên tắc hoạt động của ChatGPT và những rủi ro pháp lý mà nguyên tắc này có thể gây ra, trước tiên bạn phải làm rõ tiền thân của nó. mô hình ngôn ngữ dựa trên mạng lưới thần kinh—— Mô hình ngôn ngữ dựa trên thống kê hoạt động như thế nào. Ở giai đoạn mô hình ngôn ngữ dựa trên số liệu thống kê, các kỹ sư AI tiến hành thống kê số lượng lớn văn bản ngôn ngữ tự nhiên để xác định xác suất kết nối tuần tự giữa các từ. Khi mọi người đặt câu hỏi, AI bắt đầu phân tích môi trường ngôn ngữ bao gồm các từ tạo nên. Tiếp theo, những tổ hợp từ nào có xác suất cao, sau đó ghép các từ có xác suất cao này lại với nhau để trả về câu trả lời dựa trên số liệu thống kê. Có thể nói, nguyên tắc này đã thấm nhuần vào sự phát triển của công nghệ xử lý ngôn ngữ tự nhiên kể từ khi nó xuất hiện. Ở một khía cạnh nào đó, các mô hình ngôn ngữ dựa trên mạng thần kinh tiếp theo cũng là những sửa đổi của các mô hình ngôn ngữ dựa trên thống kê. Để đưa ra một ví dụ dễ hiểu, nhóm Sajie nhập câu hỏi “Ở Đại Liên có điểm du lịch nào?” vào hộp trò chuyện ChatGPT, như trong hình bên dưới: Bước đầu tiên của AI sẽ phân tích các hình thái cơ bản ở đó. câu hỏi "Đại Liên, cái nào, địa điểm du lịch" , sau đó tìm tập hợp văn bản ngôn ngữ tự nhiên trong đó các hình vị này nằm trong kho văn bản hiện có, tìm cách sắp xếp thứ tự có xác suất xuất hiện cao nhất trong bộ sưu tập này, sau đó kết hợp các cách sắp xếp này để tạo thành cách sắp xếp cuối cùng trả lời. Ví dụ: AI sẽ thấy rằng từ "Công viên Trung Sơn" nằm trong kho ngữ liệu của ba từ "Đại Liên, du lịch, khu nghỉ dưỡng" với khả năng xuất hiện cao nên sẽ trả về "Công viên Trung Sơn" Một ví dụ khác. là từ "công viên" được liên kết với các khu vườn, Các từ như hồ, đài phun nước và tượng có xác suất trùng khớp cao nhất nên nó sẽ tiếp tục quay trở lại "Đây là một công viên lịch sử với những khu vườn, hồ nước, đài phun nước và tượng tuyệt đẹp ."Nói cách khác, toàn bộ quá trình dựa trên thống kê xác suất dựa trên thông tin văn bản (corpus) ngôn ngữ tự nhiên hiện có đằng sau AI, do đó, các câu trả lời trả về cũng là “kết quả thống kê”, khiến ChatGPT trở nên “nghiêm túc” trong nhiều vấn đề. vô lý". Giống như câu trả lời cho câu hỏi “Ở Đại Liên có điểm du lịch nào?”, dù Đại Liên có Công viên Trung Sơn nhưng ở Công viên Trung Sơn lại không có hồ nước, đài phun nước và tượng. Đại Liên từng có "Quảng trường Stalin" trong lịch sử, nhưng Quảng trường Stalin từ đầu đến cuối chưa bao giờ là quảng trường thương mại, và nó không có bất kỳ trung tâm mua sắm, nhà hàng hay địa điểm giải trí nào. Rõ ràng, thông tin mà ChatGPT trả về là sai sự thật. 2. ChatGPT hiện là kịch bản ứng dụng phù hợp nhất cho các mô hình ngôn ngữ. Mặc dù chúng tôi đã giải thích thẳng thắn những nhược điểm của mô hình ngôn ngữ dựa trên thống kê trong phần trước, nhưng suy cho cùng, ChatGPT là một mô hình dựa trên mạng thần kinh đã cải thiện đáng kể dựa trên thống kê. mô hình ngôn ngữ ChatGPT là mô hình ngôn ngữ có nền tảng kỹ thuật, Transformer và GPT, đều là thế hệ mô hình ngôn ngữ mới nhất về cơ bản kết hợp dữ liệu khổng lồ với mô hình Transformer có tính biểu cảm cao để tiến hành mô hình hóa ngôn ngữ tự nhiên rất chuyên sâu. các câu nói đôi khi “vô nghĩa”, thoạt nhìn vẫn giống như “phản ứng của con người”. Do đó, công nghệ này có phạm vi ứng dụng rộng rãi trong các tình huống đòi hỏi sự tương tác lớn giữa con người và máy tính. Hiện tại, có ba kịch bản như vậy: thứ nhất, công cụ tìm kiếm; thứ hai, cơ chế tương tác giữa con người và máy tính trong ngân hàng, công ty luật, các trung gian khác nhau, trung tâm mua sắm, bệnh viện và nền tảng dịch vụ của chính phủ, chẳng hạn như những nơi ở trên. , hướng dẫn và điều hướng y tế, hệ thống tư vấn của chính phủ; thứ ba, cơ chế tương tác của ô tô thông minh, nhà thông minh (như loa thông minh, đèn thông minh), v.v. Một công cụ tìm kiếm kết hợp các công nghệ trò chuyện AI như ChatGPT có thể sẽ áp dụng cách tiếp cận dựa trên công cụ tìm kiếm truyền thống được bổ sung bởi mô hình ngôn ngữ dựa trên mạng thần kinh. Hiện tại, những gã khổng lồ tìm kiếm truyền thống như Google và Baidu đã tích lũy sâu về công nghệ mô hình ngôn ngữ dựa trên mạng lưới thần kinh. Ví dụ: Google có Sparrow và Lamda có thể so sánh với ChatGPT. "Nhân hóa".Việc ứng dụng các công nghệ trò chuyện AI như ChatGPT trong hệ thống khiếu nại của khách hàng, điều hướng hướng dẫn trong bệnh viện và trung tâm mua sắm, hệ thống tư vấn chính phủ của các cơ quan chính phủ sẽ giảm đáng kể chi phí nhân sự của các đơn vị liên quan và tiết kiệm thời gian liên lạc. các câu trả lời dựa trên số liệu thống kê có thể Tạo ra các câu trả lời có nội dung sai hoàn toàn, dẫn đến rủi ro kiểm soát rủi ro có thể cần được đánh giá thêm. So với hai kịch bản ứng dụng trên, rủi ro pháp lý khi ứng dụng ChatGPT trở thành cơ chế tương tác giữa con người và máy tính đối với các thiết bị nêu trên trong các lĩnh vực như ô tô thông minh và nhà thông minh nhỏ hơn nhiều, vì môi trường ứng dụng trong các lĩnh vực đó tương đối riêng tư. và nội dung lỗi của phản hồi AI không gây ra rủi ro pháp lý lớn, loại kịch bản này không có yêu cầu cao về độ chính xác của nội dung và mô hình kinh doanh đã trưởng thành hơn. 3. Khám phá sơ bộ về các rủi ro pháp lý và lộ trình tuân thủ của ChatGPT. Đầu tiên, bối cảnh pháp lý chung về trí tuệ nhân tạo ở quốc gia của tôi cũng giống như nhiều công nghệ mới nổi mà ChatGPT đại diện cũng đang phải đối mặt với “tình thế khó xử của Collingridge”. Tình thế tiến thoái lưỡng nan này bao gồm tình thế khó xử về thông tin và tình thế khó xử về kiểm soát. Cái gọi là tình thế tiến thoái lưỡng nan về thông tin có nghĩa là không thể lường trước được hậu quả xã hội của một công nghệ mới nổi trong giai đoạn đầu của công nghệ đó; Khi phát hiện ra những hậu quả xã hội bất lợi, công nghệ thường trở thành một phần của toàn bộ cơ cấu kinh tế xã hội, khiến việc kiểm soát một cách hiệu quả những hậu quả xã hội bất lợi đó là không thể. Hiện nay, lĩnh vực trí tuệ nhân tạo, đặc biệt là lĩnh vực công nghệ xử lý ngôn ngữ tự nhiên đang trong giai đoạn phát triển nhanh chóng. Công nghệ này có khả năng rơi vào cái gọi là “Tình thế lưỡng nan Collingridge”, và dường như chưa có sự giám sát pháp lý tương ứng. để "theo kịp tốc độ." Hiện tại ở nước ta chưa có luật về ngành trí tuệ nhân tạo cấp quốc gia, nhưng đã có những nỗ lực lập pháp địa phương có liên quan. Mới tháng 9 năm ngoái, Thâm Quyến đã công bố luật đặc biệt quốc gia dành cho ngành trí tuệ nhân tạo, "Quy định thúc đẩy ngành công nghiệp trí tuệ nhân tạo của Đặc khu kinh tế Thâm Quyến", và sau đó Thượng Hải cũng thông qua "Quy định của Thượng Hải về thúc đẩy phát triển ngành trí tuệ nhân tạo I". tin rằng sẽ sớm có nhiều nơi Tất cả sẽ đưa ra luật tương tự cho ngành trí tuệ nhân tạo. Về quy định đạo đức của trí tuệ nhân tạo, Ủy ban Chuyên môn Quản trị Trí tuệ Nhân tạo Thế hệ Mới Quốc gia cũng đã ban hành “Bộ quy tắc đạo đức Trí tuệ Nhân tạo Thế hệ Mới” vào năm 2021, đề xuất lồng ghép đạo đức và đạo đức vào toàn bộ vòng đời nghiên cứu và phát triển trí tuệ nhân tạo và Có lẽ trong tương lai gần, “Ba định luật của người máy” giống như trong tiểu thuyết của Asimov sẽ trở thành những định luật sắt chi phối lĩnh vực trí tuệ nhân tạo.Thứ hai, rủi ro pháp lý về thông tin sai lệch do ChatGPT mang lại đã chuyển trọng tâm từ vĩ mô sang vi mô. Đặt bối cảnh pháp lý chung của ngành trí tuệ nhân tạo và quy định đạo đức của trí tuệ nhân tạo sang một bên, các vấn đề tuân thủ thực tế hiện có trong nền tảng. trò chuyện AI như ChatGPT cũng cần được quan tâm khẩn cấp. Vấn đề rắc rối hơn là những thông tin sai lệch mà ChatGPT trả lời Như đã đề cập ở phần thứ hai của bài viết này, nguyên tắc hoạt động của ChatGPT có nghĩa là những câu trả lời của nó có thể hoàn toàn "vô nghĩa nghiêm trọng". thực sự là cực kỳ sai lầm. Tất nhiên, những câu trả lời sai cho những câu hỏi như “Có những điểm du lịch nào ở Đại Liên?” có thể không gây ra hậu quả nghiêm trọng, nhưng nếu ChatGPT được áp dụng cho các công cụ tìm kiếm, hệ thống khiếu nại của khách hàng, v.v., những thông tin sai lệch mà nó trả lời có thể gây ra cực kỳ nghiêm trọng. rủi ro pháp lý. Trên thực tế, những rủi ro pháp lý như vậy đã xuất hiện. Galactica, một mô hình ngôn ngữ dành cho lĩnh vực nghiên cứu khoa học của dịch vụ Meta, được ra mắt gần như cùng thời điểm với ChatGPT vào tháng 11 năm 2022, đã bị người dùng đóng cửa chỉ sau 3 ngày thử nghiệm. do vấn đề với các câu trả lời đúng và sai lẫn lộn. Với tiền đề là các nguyên tắc kỹ thuật không thể bị phá vỡ trong thời gian ngắn, nếu ChatGPT và các mô hình ngôn ngữ tương tự được áp dụng cho các công cụ tìm kiếm, hệ thống khiếu nại của khách hàng và các lĩnh vực khác, chúng phải được chuyển đổi để tuân thủ. Khi phát hiện người dùng có thể đặt câu hỏi chuyên môn, người dùng nên được hướng dẫn để tham khảo ý kiến của chuyên gia tương ứng thay vì tìm kiếm câu trả lời từ trí tuệ nhân tạo, đồng thời, người dùng cần được nhắc nhở rõ ràng về tính xác thực của các câu hỏi được trả về. bởi cuộc trò chuyện AI có thể cần xác minh thêm để giảm thiểu rủi ro về rủi ro tuân thủ tương ứng. Thứ ba, các vấn đề tuân thủ sở hữu trí tuệ do ChatGPT mang lại Khi chúng ta chuyển sự chú ý từ vĩ mô sang vi mô, ngoài tính xác thực của tin nhắn trả lời AI, các vấn đề về sở hữu trí tuệ của AI trò chuyện, đặc biệt là các mô hình ngôn ngữ lớn như ChatGPT, cũng nên được đề cập. cũng gây ra vấn đề về tuân thủ. Vấn đề tuân thủ đầu tiên là liệu “khai thác dữ liệu văn bản” có yêu cầu ủy quyền sở hữu trí tuệ tương ứng hay không. Như đã nêu ở trên, nguyên tắc hoạt động của ChatGPT dựa trên một lượng lớn văn bản ngôn ngữ tự nhiên (hoặc kho ngữ liệu). ChatGPT cần khai thác và huấn luyện dữ liệu trong kho dữ liệu ChatGPT cần sao chép nội dung của kho văn bản vào cơ sở dữ liệu của chính nó. Hành vi tương ứng thường được gọi là "khai thác dữ liệu văn bản" trong lĩnh vực xử lý ngôn ngữ tự nhiên.Người ta vẫn còn tranh cãi liệu việc khai thác dữ liệu văn bản có vi phạm quyền sao chép hay không khi dữ liệu văn bản tương ứng có thể cấu thành một tác phẩm. Trong lĩnh vực luật so sánh, cả Nhật Bản và Liên minh Châu Âu đều đã mở rộng phạm vi sử dụng hợp pháp trong luật bản quyền của họ, bổ sung thêm tính năng "khai thác dữ liệu văn bản" trong AI như một tình huống sử dụng hợp lý mới. Mặc dù một số học giả ủng hộ việc thay đổi hệ thống sử dụng hợp pháp của nước tôi từ "đóng" sang "mở" trong quá trình sửa đổi Luật Bản quyền của nước tôi vào năm 2020, nhưng ý tưởng này cuối cùng đã không được thông qua. Hiện tại, luật bản quyền của nước tôi vẫn duy trì việc sử dụng hợp pháp. hệ thống được quy định chặt chẽ, chỉ có mười ba tình huống quy định tại Điều 24 của Luật Bản quyền mới có thể được công nhận là sử dụng hợp pháp. Nói cách khác, Luật Bản quyền của nước tôi hiện không bao gồm việc “khai thác dữ liệu văn bản” trong AI trong phạm vi áp dụng hợp lý. Khai thác dữ liệu văn bản vẫn yêu cầu ủy quyền sở hữu trí tuệ tương ứng ở quốc gia của tôi. Thách thức tuân thủ thứ hai là các phản hồi do ChatGPT tạo ra có phải là bản gốc không? Về câu hỏi liệu tác phẩm do AI tạo ra có phải là nguyên bản hay không, nhóm của Sajie tin rằng tiêu chí đánh giá không được khác với tiêu chí đánh giá hiện có. Nói cách khác, liệu một câu trả lời nhất định được hoàn thành bởi AI hay con người, nó phải dựa trên. tiêu chuẩn hiện hành về tính nguyên gốc. Trên thực tế, đằng sau câu hỏi này còn có một câu hỏi khác gây tranh cãi hơn. Nếu câu trả lời do AI tạo ra là nguyên bản thì người giữ bản quyền có phải là AI không? Rõ ràng, theo luật sở hữu trí tuệ của hầu hết các nước, trong đó có nước ta, tác giả của một tác phẩm chỉ có thể là thể nhân, còn AI không thể là tác giả của tác phẩm đó. Cuối cùng, nếu ChatGPT kết hợp hoạt động của bên thứ ba vào câu trả lời của mình thì các vấn đề về sở hữu trí tuệ sẽ được xử lý như thế nào? Nhóm Sajie tin rằng nếu câu trả lời của ChatGPT chứa các tác phẩm có bản quyền trong kho dữ liệu (mặc dù dựa trên nguyên tắc hoạt động của ChatGPT, xác suất xảy ra điều này là nhỏ), thì theo luật bản quyền hiện hành của Trung Quốc, trừ khi nó cấu thành việc sử dụng hợp pháp, nếu không thì việc sao chép là không được phép nếu không có sự cho phép của người giữ bản quyền.
