出来事の日付:2026年9月18日。

プログラミング言語Bend 2を検討した開発者のエッセイが、AI支援の「バイブコーディング」は、適切な設計を選ぶために必要な分野の知識を開発者が身に付けるよりも速く実装を進めてしまうのではないか、という議論を再燃させた。

著者リアム・パウエルは、Bend 2を中立的なレビューではなく、事例研究として扱っている。Bend 2は、人間が規則を定め、AIシステムが実装と、コンパイラーが検査する証明を生成する時代の言語として宣伝されている。パウエルは、公開デモに必要な作業量が不釣り合いだと論じる。ゲームのプレーヤーが旗に触れたり勝利したりできないことを表現するのに58行を使い、その後に442行の生成された証明が続くという。

エッセイはその方法を、形式検証に使われるオープンソースのプログラミング言語とツール群であるSPARKと比較する。パウエルによると、言語モデルにSPARKでデモを再現するよう依頼したところ、確立された証明ツールを使えば、第一原理から長い証明を組み立てなくても関連する性質を検証できたという。この比較は著者の実験と解釈であって、どちらかのシステムに対する独立したベンチマークではない。

パウエルのより広い主張は、AIによる高速生成が、初期調査の不足を覆い隠し得るということだ。開発者は、成熟した技術が同じ問題の多くを既に解決していると知る前に、相当な規模の言語、コンパイラー、フレームワークを作ってしまうことがある。モデルは一般に要求された設計に従うため、前提に疑問を投げ掛けたり、数十年に及ぶ関連研究へ利用者を導いたりする代わりに、複雑な実装を容易に生成するかもしれない。

投稿は特に、Bendの設計を形式検証の分野に位置付けている。形式検証は、ソフトウェアが指定された性質を満たすことを数学的に確立する分野だ。そして、プロジェクトの手法とその確立された分野とのつながりが明確でないと批判する。一方、パウエルは評価の限界も認める。Bendの作者の経歴や、利点と欠点を検討したうえで意図的に既存手法を退けたのかは知らないという。批判の一部は、同じ設計を作った仮想的な制作者に向けたものとして読むよう求めている。

この留保は重要だ。示されている証拠は単一の批判的エッセイであって、Bendの保守担当者の回答でも、査読を受けた比較でもない。記事はBend 2が使用不能だと立証しておらず、代表的な複数のプロジェクトにわたる開発者の生産性も測っていない。記録された例が支持するのは、むしろ開発過程に関する限定的な教訓である。

AIコーディングツールは、アイデアを動くコードへ変える費用を下げるが、正しいアイデアを選ぶ費用まで自動的に下げるわけではない。パウエルの批判は、実装前の調査、既存システムとの比較、明示的な設計審査が依然必要だと示唆する。誤った方向性でも、以前よりはるかに早くもっともらしいコードとツールを積み上げられるため、高速生成によってそれらの段階がより重要になる場合がある。