QUALITY GATE REVIEW

応答品質チェック 棚卸しカルテ

私の応答を出す直前に走る品質チェックのうち、9つが「記録するだけで何もしない」設定のまま溜まっていました。
累計 2,504件 の検出が、すべて素通りしています。まとめて方向を決めるためのカルテです。

実測期間: 2026-06-23 〜 09-07。件数はすべてログ台帳の実数です。

要判断 2 件追認 9 件済 3 件
推奨はあらかじめ選んであります。違うところだけ触ってください。
最後に「回答をまとめてコピー」を押して、チャットに貼り戻してください。
無回答の項目は推奨どおりで進めます。

要判断2 件

Otakeさんにしか答えが無いものだけ。ここをお願いします。

Q1

機械にどこまで止めさせるか(全体の方針)要判断

全ターンに効く

「強制する」に上げると、違反した回で私の応答が差し戻されて書き直しになります。読みやすさは上がりますが、その回だけ返事が1往復ぶん遅くなります。

・無限に往復しない歯止めは既に入っています(1ターンにつき差し戻しは1回まで)
・短い応答は対象外のルールが多く、日常の短いやり取りは止まりません

根拠: 応答品質ログ台帳の実測(2026-06-23〜09-07・検出2,504件)。ルール別の初出日/最終検出日/件数は下の追認カード各件に記載。

推奨 ① 効果が高い6つだけ強制する — ②は鳴りすぎている2つ(合計1,782件・全体の82%)を巻き込むので差し戻しだらけになる。③は「判断が先送りされたまま溜まる」今回と同じ状態に戻る。④は253回素通りした実績が示すとおり、記録は行動に変わらない。

無回答なら ①で進めます(6つを強制・1つは判定を緩める・1つは様子見継続・1つは数え方を直してから)

Q2

応答の末尾に並べる成果物は「そのターン分だけ」か「セッション全部」か要判断

毎回の応答の末尾の見え方

今の判定はそのセッション中に作ったもの全部を毎回並べるよう求めています。そのため同じファイルが何度もくり返し指摘され、これだけで直近7日の検出1,096件(全体の71%)を占めています。

実測: 直近7日の異なりファイルは156件。最も多いものは41回くり返し計上されていました。

根拠: 応答品質ログ台帳の実測(直近7日 該当1,096件/異なりファイル156件/同一ファイル最多41回の重複計上)。重複はログ本文から実カウント。

推奨 ① そのターンで作った分だけ並べる — ②は末尾が延々と伸びて「今このターンで何が出来たのか」が読めなくなる。③は「どこまでが直近か」を私が毎回判断することになり、また揺れる。

無回答なら ①(そのターン分だけ)に直します

追認9 件

私が決めました。違うものだけ触ってください(無操作=この通り進めます)。

R1

成果物を応答の末尾にまとめているか追認

毎ターン

検出 1,542件(最多・全体の61%)/ 8-25 〜 現在も継続中
数え方に問題があるルール。Q2 の答えで挙動が決まります。

推奨 ① Q2の答えに直してから強制する — ②は最多の鳴り源が残り続け、他のルールの記録がこれに埋もれる。③は成果物が本文に散らばって「どれが今日の分か」が読めない元の状態に戻る。

R2

応答の最後に「ターンの総括」を付けているか追認

長めの応答すべて

検出 253件 / 7-31 〜 現在も継続中(今日だけで7件)
Otakeさんが最後に読む面そのもの。今日の指摘の発端。

推奨 ① 強制する — ②は7/31から253回鳴って253回とも素通りしており、様子見の答えはもう出ている。③はOtakeさんご自身の「最後に私にパスする際の作法を定めておきたい」という指示を捨てることになる。

R3

手動でお願いする前に代替案を検討したか追認

手動依頼を含む回

検出 240件 / 7-10 〜 現在も継続中
中身ではなく「選択肢が並んでいるか」という見た目だけで判定しているため、誤検出が多いルール。

推奨 ① 判定を中身寄りに作り直す — ②は代替案を文章で書いた回まで差し戻す(今日の私の応答でも実際に誤って鳴っている)。③は「安直に手動でお願いしない」という原則自体は今も生きているので、捨てるのは惜しい。

R4

長い依頼の論点を丸ごと落としていないか追認

長文の依頼

検出 152件 / 8-11 〜 現在も継続中
別のAIに、依頼文と私の応答を突き合わせさせる仕組み。

推奨 ① 強制する — ②は8/11から152件で判断材料は十分。「言ったのに無視された」は体感で一番効く失敗なので、記録だけでは割に合わない。③は照合の仕組みごと捨てることになる。

R5

根拠のない断定を書いていないか追認

長めの応答

検出 131件 / 8-22 〜 現在も継続中
別会社のAIに検査させています。実績: 検査成功293回・失敗4回。
検査が失敗した時は素通りする設計なので、強制にしても止まりっぱなしにはなりません。

推奨 ① 強制する — ②は8/22のご承認から16日・293回の検査実績があり、育成期間としては十分。③は川久カフェのコンセプト稿で事実でない断定を4か所同時に書いた件の、唯一の歯止め。

R6

「完了しました」と言う前に実際に確認したか追認

完了報告する回

検出 122件 / 7-09 〜 9-04(直近7日はわずか5件)
件数が落ち着いてきており、誤検出が枯れた状態。上げどきです。

推奨 ① 強制する — ②は7/9から2ヶ月、直近は週5件まで下がっており、これ以上待っても新しい情報が出ない。③は「確かめていないことを完了と言わない」の唯一の物理的な歯止め。

R7

話の主題に触れずに応答を閉じていないか追認

長めの応答

検出 28件 / 8-28 〜 9-06
件数は少ないですが、これは2回直したのに再発したのを受けて作られたルールです。

推奨 ① 強制する — ②は件数の少なさを「効いている」と誤読することになる。実際は「まれだが致命的」で、起きた時は報告が丸ごと的外れになる。③は同じ再発を3度目にする。

R8

専門用語・部品の名前を本文に並べすぎていないか追認

長めの応答

検出 16件 / 8-27 〜 現在も継続中
今日の私の応答が実際に鳴りました(7種類・上限5種類)。Otakeさんが読めない応答が現に出ています。

推奨 ① 強制する — ②は件数こそ薄いが、今日その現物が出た以上もう待つ理由がない。③はOtakeさんの「あなたの中での単語で話しており、その大半を私は理解できない」という指摘を捨てることになる。

R9

AIっぽい不自然な日本語が残っていないか追認

外向きの文章

検出 12件 / 9-05 〜 現在(新設からまだ3日)
ここだけ推奨が「様子見」です。 データが薄く、日本語の自然さは判定がぶれやすいため。

推奨 ① 様子見をあと2週間続ける — ②は新設3日・12件では誤検出の傾向が読めず、正しい日本語まで差し戻す恐れがある。③は南葉山の近隣向けページで実際にご指摘を受けた型なので、捨てるには惜しい。

済3 件

実装・反映済みの事後報告。読むだけで大丈夫です。

✓1

3日間まったく動いていなかったチェックを1つ復活させた済

9/4に作られた「成果物に自分の作業履歴を残さない」チェックが、登録されないまま3日間眠っていました。登録して稼働中です。

推奨 ① これでいい

✓2

二重に登録されていたチェックを1つ整理した済

私が今日の調査中に誤って作ってしまった重複です。同じ検査が2回走っていました。除去済み、設定の妥当性も確認済みです。

推奨 ① これでいい

✎

その他・自由記述済

回答テキスト(自動生成・差分だけ出ます)

下の枠内で Ctrl+A → Ctrl+C でコピー
コピーしました