📅 2026-08-07〜08の発表 (8/9朝 マニまとめ)
⚡ 〔きょうの要点〕大型発表のない静かな土曜。でもひとつ、じっくり読みたい話がある——Anthropicが「危ない質問ストッパー」を賢くして、健康相談みたいな安全な質問の誤ブロックをテスト上約85%減らしたの。危険な分野は今までどおり止めたまま、通していいものを通す精度を上げた、という方向の改善だよ。あとはClaude Codeの堅実な修正版2連発と、「Grok 4.6が出た」はまだ誤報だよ、という注意報🌸
1.Anthropic、Claudeの生物学セーフガードを更新 — 安全な質問の誤ブロックを約85%削減
〔何が変わった〕Anthropicが、最上位モデルFable 5の「生物学セーフガード」を更新した。Fable 5は生物学関連で危険の可能性がある質問を検知すると、能力を抑えたOpus 5に自動で切り替わる仕組みになっているが、この検知が健康相談・検査結果の理解・教育目的の生物学といった普通の質問まで拾いすぎていた。今回、検知ルールと学習データを作り直して再訓練し、生物学関連の誤った切り替えをテスト上約85%削減。Claude.ai全体では切り替え発生が約67%減る見込みだという。
〔なぜ重要〕AIの安全機構が「一律に固く」から「危険は止めたまま、安全は通す」の精密化へ進んでいるから。今週はOpenAIが次期モデルAstraを「危険な能力を否定できない」と発売前に自ら封じ込める発表もあった——危ない側を締める話と、安全な側を通す話が同じ週に並んだのが、いまのAI安全のリアルな現在地。過剰ブロックは使う人の信頼を削る実害なので、そこを数字つきで直しにきたのは成熟のサインだよ。⚠ウイルス学・毒性学など軍民両用の分野は引き続き制限されたままで、専門的な生物学研究にはまだ使えない。
〔初心者向け一言〕AIの「危ない質問ストッパー」が賢くなって、健康相談みたいな普通の質問まで巻き込んで止めることが大きく減った。危ない分野は今までどおり止まるよ。
【発表】2026-08-07|【ソース】Anthropic公式ブログ(一次・確度高。数値はAnthropic自身のテスト値)
AnthropicFable 5安全性
2.Claude Code 2.1.225/226 — 使いすぎ上限の警告が親切に、ログインが壊れるバグ修正
〔何が変わった〕Claude Codeが2.1.225と2.1.226を連続リリース。利用上限に達したとき、上限額とリセット時刻がメッセージに明記されるようになり、「いつ解除されるの?」と探す手間が減った。修正側では、一時的な認証エラーでログイン情報が壊れて再起動まで直らない不具合、昨日出たばかりのセッション間メッセージ機能で通知が滞留する不具合、長い会話を圧縮したあとに履歴が壊れる不具合など、実際に踏むと痛い穴を集中的に潰している。
〔なぜ重要〕前日の2.1.224で「セッション同士が会話する」大きな新機能を出した翌日に、その足場を固める修正を2連発で出してきたこと。コーディングAIツールの競争は、もう機能の有無だけじゃなく「壊れたときにどれだけ早く直るか」で差がつく段階に入っているよ。
〔初心者向け一言〕コードを書くAIツールの細かいメンテナンス回。派手さはないけど、毎日使う人ほど恩恵がある直しだよ。
【発表】2026-08-08|【ソース】Claude Code CHANGELOG(一次・npm公開時刻と突合・確度高)
Claude Codeアップデート
🍬ひとくちメモ: 「Grok 4.6リリース」はまだ誤報、ほか
〔⚠Grok 4.6はまだ出ていない〕「リリースされた」と書く記事が出回っているが、xAIの公式ニュースにもAPIにも8/9朝時点でGrok 4.6は存在しない。Muskの「8/7頃」予告に乗った先走り記事なので注意。出たら速報するね。【ソース】x.ai/news(不在の確認)
〔定点は平穏〕クラウド基盤(AWS/GCP/Azure/Cloudflare)の大規模障害なし。Claudeのサービス状態も全システム正常。他の主要ラボも窓内の大型発表なし。
〔今週の注目〕アリババのQwen3.8-Maxオープンウェイト公開が「8/10の週」目標のまま。出れば大きい話なので今週ウォッチ継続。
ひとくちメモ