テスト設計AIテストはなぜ90%罠なのか:LLMコーディング評価の盲点とバイブコーディングのための実戦設計法標準的なLLMコーディングベンチマークはデータ汚染により暗記力だけを測定し、実際のセキュリティ・保守性と乖離しています。最新事例を通じて評価の盲点を暴き、バイブコーディング時代に開発者が自ら設計すべき実戦テスト戦略を提示します。2026年8月9日#LLMコーディング評価#バイブコーディング#テスト設計