今週メインネットベータが稼働するという話を読んでいました。Newton Protocol は数日前にそれを公開していて、ちょうど私がこのタスクを積んでいたタイミングでした。しかも私は、今まさに稼働している「Recurring Buy」エージェントのことをずっと考えていました。というのも、まさにそこがテストされている本質だからです。AI があなたに代わって、監視なしで取引を実行する。$NEWT @NewtonProtocol #Newt 。
そこで私は境界の部分を探しに行きました。つまり、そのエージェントに実際どこまでの“リード”があるのか、ということです。技術的には、ちゃんとあります。ポリシーが支出上限、頻度、資産の範囲を定めていて、実行前にオペレーターネットワークを通じて強制され、実行後には Newton Explorer で検証できます。問題ありません。説明どおりに動いています。
でも、私に引っかかったのはここでした……その境界はエージェントが持っているものではないのです。人間がまず先に、正しく、事前に設定しなければならないものであり、その後は誰かが更新するまで維持されることを信頼するしかない。私は、もっと何か、奇妙な状況に自動で適応して調整するようなガードレールを期待していました。そうではありません。これは、一度作って、あとはほとんど忘れてしまう静的な柵です。
まあ、うーん――それって、結局のところ、私がこれまで何かに対して設定してきた支出上限を全部どう扱ってきたかと同じなんですよね。一度設定して安心し、何も起きるまで二度と見直さない。
つまり、ここでいう「安全性」は、タイムスタンプ付きで検証可能になった規律にすぎません。知能ではない。
今この瞬間、稼働中のエージェントのうち、ローンチ当日以降誰にも触られていない上限の上で動いているものがどれだけあるんだろう。
そこで私は境界の部分を探しに行きました。つまり、そのエージェントに実際どこまでの“リード”があるのか、ということです。技術的には、ちゃんとあります。ポリシーが支出上限、頻度、資産の範囲を定めていて、実行前にオペレーターネットワークを通じて強制され、実行後には Newton Explorer で検証できます。問題ありません。説明どおりに動いています。
でも、私に引っかかったのはここでした……その境界はエージェントが持っているものではないのです。人間がまず先に、正しく、事前に設定しなければならないものであり、その後は誰かが更新するまで維持されることを信頼するしかない。私は、もっと何か、奇妙な状況に自動で適応して調整するようなガードレールを期待していました。そうではありません。これは、一度作って、あとはほとんど忘れてしまう静的な柵です。
まあ、うーん――それって、結局のところ、私がこれまで何かに対して設定してきた支出上限を全部どう扱ってきたかと同じなんですよね。一度設定して安心し、何も起きるまで二度と見直さない。
つまり、ここでいう「安全性」は、タイムスタンプ付きで検証可能になった規律にすぎません。知能ではない。
今この瞬間、稼働中のエージェントのうち、ローンチ当日以降誰にも触られていない上限の上で動いているものがどれだけあるんだろう。
