Tôi không thể vượt qua nhất trong hai năm dùng AI, là việc tôi mãi mãi không thể tự kiểm chứng đáp án—cho đến khi thấy OpenGradient, mỗi lần suy luận đều kèm theo một bản chứng minh mật mã, rồi tôi mới nghĩ rằng cuối cùng cũng có người dám mổ cái “hộp đen” này.
Tôi có trải nghiệm trực tiếp. Gần đây, tôi dùng một vài mô hình phổ biến để tra cứu theo các điều khoản/chuẩn mực tuân thủ. Nghe câu trả lời rất thuyết phục, lật vài trích dẫn thì trong ba cái có hai cái là nó tự bịa; hỏi lại bằng một số khác cho cùng một câu, đáp án lại đổi, còn việc mô hình có lặng lẽ đổi hay không thì nó không nói cho tôi biết. Cái hố “hộp đen” không chỉ là quyền riêng tư—mà là liệu đáp án bạn nhận có phải đúng là thứ mô hình đang chạy trong môi trường mà bạn tưởng tượng hay không. $RE
Nói ví dụ liên ngành: AI phổ biến giống như taxi không gắn camera hành trình; đường có bị chạy vòng hay không, tài xế có chở vòng hay không, chuyện đó phụ thuộc vào việc bạn tự bịa lại sau khi xảy ra. Còn khi gắn camera hành trình, mỗi cây số đều có thể lần ngược. OpenGradient làm đúng việc gắn “camera hành trình” cho AI: mỗi lần suy luận kèm một bản chứng minh mật mã, ai, dùng mô hình nào, trong loại môi trường nào, tạo ra gì—bất kỳ ai cũng có thể tự kiểm chứng độc lập, không cần tin lời khai của nhà cung cấp.
Trước đây tôi nghĩ kiểm chứng được chỉ là sự “kén kỹ sư”, không có giá trị cho người dùng. Chỉ khi lục dữ liệu công khai tôi mới điều chỉnh lại: hơn 2 triệu lượt suy luận có thể kiểm chứng, hơn 500 nghìn bản chứng minh mật mã, phủ hơn 2 triệu người dùng—đây không phải demo, mà là lưu lượng thực tế đã chạy. AI có thể kiểm chứng lần đầu chạm đến quy mô người dùng mức tiêu dùng, không còn là mấy đồ chơi zk trong paper.
Tôi không làm người đứng ra bảo lãnh cho nó. Mỗi bản chứng minh đều có chi phí tính toán; nếu phóng lên mức hàng trăm triệu đến hàng tỷ lần suy luận, đường cong chi phí vẫn chưa được ép xuống. Chứng minh chỉ đảm bảo là mô hình đó thật sự đã chạy; nó không thay bạn bảo đảm rằng mô hình không bịa. Hộp đen đã được mổ ra rồi—bên trong có phải kẻ lừa đảo hay không, thì chuyện đó là vấn đề khác; còn ở giai đoạn testnet, hệ thống chứng minh nâng cấp một lần thì một số tính chất của phiên bản cũ có thể sẽ thay đổi.
Những điều tôi muốn xem cũng khá thẳng thắn. Tôi muốn biết sau khi OpenGradient lên mainnet, chi phí end-to-end của bộ chứng minh có nén thêm được một bậc nữa không; muốn xem công cụ kiểm chứng độc lập bên thứ ba có chạy ra kết quả đúng với bản chính thức hay không; và cũng muốn biết một ngày nào đó có ứng dụng AI sẵn sàng gắn luôn hash của chứng minh cho từng đầu ra ngay trên giao diện để người dùng xem. Chừng nào mấy điều này chưa làm được, thì việc “mổ hộp đen” là việc tốt—nhưng bên trong rốt cuộc gắn cái gì, bạn vẫn phải tự nhìn thêm một lần nữa. $HEI
#opg $OPG @OpenGradient
opg 的答案可以看到思想过程
67%
不都是瞎编的答案吗
33%
3 phiếu bầu • Cuộc bỏ phiếu đã kết thúc