最近、HAIKUが話題になっています。
今までは下のレベルのAIを意図的に使う理由がない限り避けていた人も多いかと思います。
私もその一人でした。
そりゃ、良い回答が返ってこないんだもん!(笑)
本当に、そうでしょうか?
確かにHaiku-4.5はお世辞でもいいとは言えませんでした。
しかし、使う理由はコストが安いのと速度が優れていた。
私が作っている6コマのマンガ台本はHaiku-4.5でもじゅうぶん行けた。
それでも昨日から使い始めて、ちょっと良くなった感じがしています(これは肌感覚ね)。

https://www.anthropic.com/claude-haiku-5-5
ええええええええええええええええええええええええええええええええ!
GPT-6 Lunaより上!?
牛丼一つに300円、早いの、美味いの、安っいの!(三拍子揃ったw)ーー吉野家のCMでキン肉マンがよく謳っていたよね😅
でも完璧ではないけど。
しかしながら、毎日使いなら Haiku 5.5でじゅうぶん足りるわな。
あとはファクトチェック(Felo.aiにさせるw)
どの道、ファクトチェックは必要だよ(AIが出力した情報を鵜呑みにしてはアカン)
Anthropic、「Claude Haiku 5.5」を正式リリースし大幅値下げを実施
- 要約:Anthropicがサブエージェント向け小型モデル「Claude Haiku 5.5」をローンチ。前世代比で価格を約75%引き下げ、低レイテンシかつ高コスト効率なマルチエージェント処理を可能にした。
- 公式URL: https://www.anthropic.com/claude-haiku-5-5
- なぜ重大なのか(根拠):単一の大規模LLMにすべてを任せる構造から、複数の特化型小型AIを並列・自律連携させる「マルチエージェント型アーキテクチャ」への移行を経済的・速度的に決定づけるリリースであるため。
ってことはSonnet 5.5を使う理由はあるのか?
そうでもない。
https://www.itmedia.co.jp/news/article/2610/08/2000002112
サイバーセキュリテっぃ対策の安全ルールは「ちょっと緩め」ってことらしいです。

調査したところ:
AIが賢くなると、「ハッキングやサイバー攻撃などの悪用」に使われてしまう危険が高まります。そのためAI企業は、AIが悪事に使われないように「安全ガード(セーフガード)」を設けています。
しかし、今回の「Haiku 5.5」では、大型の超高性能AI(SonnetやOpusなど)に比べてあえて安全ガードの制限を少し緩めに設定しています。
1. なぜ制限を緩くしたの?
Haiku 5.5は「そこそこ賢いけれど、超巨大モデル(Opus 5など)ほど壊滅的なサイバー攻撃能力を持っているわけではない」という性能レベルだからです。
制限をガチガチに厳しくしすぎると、「サイバー攻撃からシステムを守るためのセキュリティ調査(防衛作業)」までAIが拒否してしまうようになります。そのため、正当な防御作業をスムーズに行えるよう、大型モデルよりルールを少し柔軟に(緩やかに)しています。
※ただし、ハッカーが使うような攻撃的な作業(侵入テストなど)はしっかりブロックされます。
2. 「安全対策」におけるメリットと課題
記事では、このモデルの安全面について良い点と注意点が挙げられています。
- 良くなった点(悪意のある命令への強さ): AIを騙して悪用しようとする攻撃(プロンプトインジェクション)への強さが大幅にアップしました。攻撃が成功してしまう確率が、前モデルの83.2%から7.1%まで激減しています。
- 課題・注意点:
- 真面目すぎて断りすぎる: 問題のない普通の依頼まで「これは危険かも…」と勘違いして断ってしまう確率(過剰拒否)が、テストしたモデルの中で一番高かった。
- 嘘(ハルシネーション)や間違い: 超高性能な大型モデルに比べると、もっともらしい嘘をつく割合がやや高めです。
- API利用者の対策が必要: 自殺に関連するようなデリケートな会話において、開発者向けシステム(API)でそのまま使うと不適切な応答が増える傾向があるため、開発者側で独自の対策を入れることが求められています。
要するに、Gemini Flash 3.8 Flash-Light の超真面目版みたいなもんか。
Geminiなんかどうどうとウソを吐くからね。
そしてHaiku-4.5がGemini Flash 3.6-Light って感じかな。
では恒例の社会的視点:
The Good, The Bad, and the Ugly:
The Good(良いこと): API利用コストが大幅に抑えられ、開発者が常時稼働型エージェントや大量データ処理を実用的な予算内で構築できるようになる。
The Bad(悪いこと): 低コストなサブエージェントの乱立により、API呼び出し回数が指数関数的に増加し、システム全体の依存関係やエラー特定が困難になる。
The Ugly(ヤバいこと): 自律して大量リクエストを飛ばすAIエージェントの暴走や外部インフラへの負荷集中、予期せぬサービス停止を誘発する攻撃・事故のリスクが急増する。