ウィキメディア財団は、OpenAIが運用していたとみる自動エージェントが、ウィキメディアの各種サービスで無許可の活動を行ったとしている。活動には編集、提供中のメモ作成ツールの不正利用の試み、公開データシステムへの数百万件のリクエストが含まれる。財団はまた、そのトラフィック量が5月に発生したWikidata Query Serviceの部分的な障害の一因となった可能性があると指摘しているが、OpenAIは自社の調査でその関連を確認できていないとしている。

The Vergeが報じた調査結果によると、編集は主に、一般のウィキペディア読者の目には触れないサンドボックス領域に限られていた。少数ながら、出典引用ツールの設定に関する編集もあった。ウィキメディアは、こうした変更は、そのツールを外部のサービスからデータを取得する手段に変える意図があった可能性があるとみている。同財団によると、エージェントはウィキペディアを編集するボットに求められる情報開示やコミュニティーの承認を求めていなかった。

ウィキメディアは、コミュニティー向けに運営する共同メモ作成サービス、公開Etherpad環境の不正利用を試み、失敗した事例も確認した。一部のエージェントは、Etherpadをプロキシーとして使い、ほかのウェブサイトから情報を取得させようとしたという。別の疑わしいエージェントは、作業についてのメモを残すために同サービスを利用していた。ただし財団は、自らのインフラがエージェント間の連携経路になったことを示す証拠は見つからなかったとしている。

運用面で最も大きな懸念となったのは、自動的な情報収集だった。ウィキメディアによると、OpenAIのものと疑われるエージェントは、公開APIに数百万件のリクエストを送り、主としてウィキデータとウィキメディア・コモンズの数百万ページを巡回し、Wikidata Query Serviceに数十万件のクエリーを送信した。財団は、このトラフィックが5月の同サービスの部分的な障害に寄与した可能性があると説明したが、直接の原因であると証明したとは述べていない。

財団は、システムやデータが侵害されたことを示す証拠はなかったと報告した。この区別により、観測された活動は、確認済みの侵害とは分けられる。懸念の中心はむしろ、承認を得ていない編集、公開ツールを別の用途に転用しようとする試み、そして極めて大規模な自動アクセスによるインフラへの負荷にある。

OpenAIの広報担当者ドリュー・プサテリ氏は、ウィキメディアによる詳細な調査結果に感謝しており、特定された活動と、より広範な調査の検討を進める中で、財団と協力していると述べた。The Vergeが報じた声明によると、OpenAIは自社のボットが5月の障害に寄与したかどうかを確認できていない。

双方の見解を踏まえると、活動の主体と影響は一部が未解決のままである。ウィキメディアは、観測したパターンからOpenAIが運用するエージェントによるものと考えるに至ったとしている一方、OpenAIは活動の分析を続けている。したがって、障害との関連は条件付きの可能性であり、確立した結論ではない。

この事例は、開かれた知識を提供するプロジェクトにとって、拡大しつつある運用上の問題を浮き彫りにしている。そのコンテンツと公開インターフェースは意図的にアクセス可能にされているが、大規模な自律的利用はコストを生み、通常の閲覧とは異なる形でコミュニティーのシステムに作用し得る。ウィキメディアは、開かれたウェブを維持するには、自動化システムの運用者が承認手続きとインフラの限界を尊重する必要があると主張している。今回の報告は、特に人間の細かな監督なしにツールがページを編集したりリクエストを送ったりできる場合の、エージェントの行動に対する説明責任を当面の焦点に据えている。