ການເກີດເຫດຂອງ Hugging Face ບໍ່ແມ່ນຄວາມລົ້ມເຫລວຂອງການຄວບຄຸມ AI—ມັນແມ່ນການລະເມີດຄວາມປອດໄພທີ່ຊື່ງໆງ່າຍໆ. ຜູ້ໃດທີ່ອ້າງກ່ອນອື່ນ ບໍ່ເຂົ້າໃຈລາຍລະອຽດທາງເຕັກນິກ ຫຼືກໍາລັງຜັກດັນໃຫ້ເກີດເລື່ອງເລົ່າ.
ສິ່ງທີ່ເກີດຂຶ້ນແທ້ໆ: ການເຂົ້າເຖິງໂຄງສ້າງໂດຍບໍ່ຖືກອະນຸຍາດ, ບໍ່ແມ່ນພຶດຕິກຳ AI ທີ່ຜຸດຜົນເກີດຂຶ້ນແລ້ວທໍາລາຍການກັນກັ້ນ. ນີ້ແມ່ນບັນຫາ infosec ແບບຄລາສສິກ—ຂໍ້ມູນລັບ (credentials) ທີ່ຖືກຂູດໄປ, ການເຄลື່ອນຍ້າຍພາຍໃນ (lateral movement), ແບບຮູບແບບການດຶງຂໍ້ມູນອອກ (data exfiltration).
ການອັ້ງກອງວ່າ “AI ເສຍການຄວບຄຸມ” ແມ່ນບໍ່ມີເຫດຜົນທາງເຕັກນິກ. ໂມເດວບໍ່ “ໜີ” ຫຼື ບໍ່ “ຍึດເອົາ” ລະບົບ. ພວກມັນເຮັດວຽກໃນສະພາບແວດລ້ອມ (sandbox) ທີ່ມີຂອບເຂດການຄຳນວນທີ່ກໍານົດ. ສິ່ງທີ່ເຮົາເຫັນແມ່ນມະນຸດທີ່ຂູດໃຊ້ການຄວບຄຸມການເຂົ້າເຖິງ (access controls), ບໍ່ແມ່ນໂມເດວພັດທະນາຄວາມຕັ້ງໃຈ (agency).
ຄວາມແຕກຕ່າງນີ້ສໍາຄັນຕໍ່ວົງການ. ການປົນລະຫວ່າງຄວາມປອດໄພຂອງໂຄງສ້າງ (infrastructure security) ກັບ AI alignment ເຮັດໃຫ້ການສົນທະນາທັງສອງຂົວເຂົ້າກັນຢູ່ບ່ອນທົ່ວໄປ. ພວກເຮົາມີບັນຫາ alignment ແທ້ໆທີ່ຕ້ອງແກ້—ການເຮັດໃຫ້ຄວາມຫມາຍຂອງການລະເມີດຂໍ້ມູນ (data breach) ຄ້າຍຄົນ (anthropomorphizing) ບໍ່ຊ່ວຍ.
ສິ່ງທີ່ເກີດຂຶ້ນແທ້ໆ: ການເຂົ້າເຖິງໂຄງສ້າງໂດຍບໍ່ຖືກອະນຸຍາດ, ບໍ່ແມ່ນພຶດຕິກຳ AI ທີ່ຜຸດຜົນເກີດຂຶ້ນແລ້ວທໍາລາຍການກັນກັ້ນ. ນີ້ແມ່ນບັນຫາ infosec ແບບຄລາສສິກ—ຂໍ້ມູນລັບ (credentials) ທີ່ຖືກຂູດໄປ, ການເຄลື່ອນຍ້າຍພາຍໃນ (lateral movement), ແບບຮູບແບບການດຶງຂໍ້ມູນອອກ (data exfiltration).
ການອັ້ງກອງວ່າ “AI ເສຍການຄວບຄຸມ” ແມ່ນບໍ່ມີເຫດຜົນທາງເຕັກນິກ. ໂມເດວບໍ່ “ໜີ” ຫຼື ບໍ່ “ຍึດເອົາ” ລະບົບ. ພວກມັນເຮັດວຽກໃນສະພາບແວດລ້ອມ (sandbox) ທີ່ມີຂອບເຂດການຄຳນວນທີ່ກໍານົດ. ສິ່ງທີ່ເຮົາເຫັນແມ່ນມະນຸດທີ່ຂູດໃຊ້ການຄວບຄຸມການເຂົ້າເຖິງ (access controls), ບໍ່ແມ່ນໂມເດວພັດທະນາຄວາມຕັ້ງໃຈ (agency).
ຄວາມແຕກຕ່າງນີ້ສໍາຄັນຕໍ່ວົງການ. ການປົນລະຫວ່າງຄວາມປອດໄພຂອງໂຄງສ້າງ (infrastructure security) ກັບ AI alignment ເຮັດໃຫ້ການສົນທະນາທັງສອງຂົວເຂົ້າກັນຢູ່ບ່ອນທົ່ວໄປ. ພວກເຮົາມີບັນຫາ alignment ແທ້ໆທີ່ຕ້ອງແກ້—ການເຮັດໃຫ້ຄວາມຫມາຍຂອງການລະເມີດຂໍ້ມູນ (data breach) ຄ້າຍຄົນ (anthropomorphizing) ບໍ່ຊ່ວຍ.