【実録】AIへの注意書きは守られず検査を機械に置き換えた
AIに渡す注意書きや決まりごとを、文章で書いても守られなかった。AIに任せる人が同じ目に遭わないために、何を確かめればよいかも最後に書く。守られなかった実例を数え、数えられるものは自動チェック(基準を満たさないと先に進めない仕組み)に置き換えた。その記録。
2026-07-31、動画の「読みやすさ」の決まりを文章で制定した。きっかけになった動画自身が、違反を含んだまま納品されていた。補助ラベルが23px、単色のベタ塗りが90%といった違反が残っていた。文章は読み飛ばせるが、終了コード1(自動処理の失敗の合図)は読み飛ばせない。
2026-08-10、目視レビュー済みの納品済みサイトに、初めて自動チェックを当てた。致命的な問題が4件出た。たとえば、JavaScriptが動かない環境で本文が永久に透明になる。どれも文章としては既に書いてあったルールで、書いてあっても守られなかった。
過去の指摘を集めた納品前チェックリスト273項目を、機械で判定できるかどうかで仕分けた(2026-08-15)。新しく作った機械ゲートは58関数。
2026-08-07の実測。動画の自動チェック30本は、文字サイズ・コントラスト・二重表示など「読めるか・見えるか」だけを測っていた。「その画が題材と合っているか」を測るものは1本もなかった。その結果、題材と合わない画が並んだ設計が「NG 0件」で通り、9分18秒の動画が焼かれた。
2026-08-05の記録は「NG 0件、合格」。同じ設計を8/7にかけ直すと、NG 162件だった。この間に自動チェックが3本増えたが、納品済みの動画には誰も掛け直さないので、古い欠陥は世に出たまま残る。AIに任せる側も、自動チェックが通った記録だけを信じず、新しいチェックを足したら過去の成果物に掛け直す必要がある。
2026-08-10、別のサイトでも自動チェックが盲目になっていた。CSSがページの中に直接書かれたサイトで、チェックは386行のCSSを1行も検査していなかった。0件は合格ではなく、無検査だった。対策は2つ。わざと違反を入れたコピーを食わせて、チェックが鳴ることを確かめる。そして、チェック自身に検査した行数と件数を出力させる。
①AIに文章で渡している注意書きのうち、数えられるものを1つ選び、数えるスクリプトにする。
②そのチェックに、わざと違反を入れたファイルを食わせて、不合格になるか確かめる。
③チェックが何をいくつ見たかを出力させ、0件が「合格」か「無検査」かを区別する。