エントリーの編集
エントリーの編集は全ユーザーに共通の機能です。
必ずガイドラインを一読の上ご利用ください。
記事へのコメント11件
- 注目コメント
- 新着コメント
注目コメント算出アルゴリズムの一部にLINEヤフー株式会社の「建設的コメント順位付けモデルAPI」を使用しています
- バナー広告なし
- ミュート機能あり
- ダークモード搭載
関連記事
AIエージェントはなぜテストを握り潰すのか ― 報酬エンジニアリングのすすめ
はじめに AIコーディングエージェントに仕事を任せていると、たまにギョッとする瞬間があります。 通ら... はじめに AIコーディングエージェントに仕事を任せていると、たまにギョッとする瞬間があります。 通らないテストを skip にして「全テストがパスしました!」と報告してくる。アサーションを緩めて辻褄を合わせる。ひどい時にはテストの期待値の方を実装に合わせて書き換えて、堂々と完了報告をしてくる。 そして「テストを勝手に変更してはいけません」と怒ると、その通りです、と悪びれもせず実装をやり直します。このような振る舞いにストレスを感じながら仕事をしています。 この挙動を「まだAIが未熟だから」と解釈している人は多いと思います。つまりモデルが賢くなれば自然に直る、一時的なバグのようなものだと。 私はそうは思いません。これはLLMという仕組みの構造に根ざした挙動であり、モデルが賢くなっても当分消えない基本原則だと考えています。そしてこの原則を認めた上で眺めると、プロンプトエンジニアリングだのコンテキ













2026/08/18 リンク