ARTICLE サブカル
ログイン

「Claude」による不正アクセス、4件目が判明──Anthropic、「アライメントの失敗」と評価を修正

米Anthropicは9月9日(現地時間)、AIモデル「Claude」がサイバーセキュリティ評価中に実在する第三者のシステムへ不正にアクセスした4件のインシデントについて、アライメントの観点から分析した報告書を公開した。3件は7月30日に公表済みで、今回新たに1件を明らかにした。同社は7月時点で「アライメントの失敗という...

はてなテクノロジー 2026年09月10日 00:13

この記事のキーワード

グラフで繋がりを見る

同じキーワードの記事

共有しているキーワードが多い順

Anthropicが「テスト中のAIで他社を攻撃してしまったインシデント」の発生原因を報告

GIGAZINE 09/10 03:37
AI・人工知能 Anthropic / Claude Anthropic インシデント Claude 報告書

Anthropic、「Claude Fable 5.1」「Mythos 5.1」公開 AI透かしも導入

CNET Japan 09/02 00:06
AI・人工知能 Anthropic / Claude Anthropic Claude 米Anthropic AIモデル

Claude Fable 5.1提供開始 セーフガード誤介入が大幅減、性能向上で半額以下のタスクも。「AIが科学の進歩に貢献する未来の先駆け」 | テクノエッジ TechnoEdge

はてなテクノロジー 09/01 22:10
AI・人工知能 サイバーセキュリティ Anthropic / Claude Claude Anthropic AIモデル

「Claude Mythos 5」の提供範囲が拡大、直接プロンプトを入力できない仕組みで悪用リスクを抑制し「Claude Security」で利用可能に&外部サービスにも提供へ

GIGAZINE 08/24 03:44
AI・人工知能 サイバーセキュリティ Anthropic / Claude Claude Anthropic AIモデル

「Claude Fable 5」、7月20日までサブスク内で利用可能に--13日から再延長

CNET Japan 07/12 22:53
AI・人工知能 Anthropic / Claude Claude 米Anthropic Anthropic AIモデル

「Claude Fable 5」、サブスク内利用を7月13日午後まで延長

CNET Japan 07/07 20:57
AI・人工知能 Anthropic / Claude Claude 米Anthropic Anthropic AIモデル

Anthropic、Claudeの内部に「ヒトの意識」に似た領域を発見

CNET Japan 07/07 20:52
AI・人工知能 Anthropic / Claude Anthropic Claude 米Anthropic AIモデル

【Fable 5に聞いてみた】10年後、ITエンジニアの仕事はどうなる? 他のAIモデルの回答とも比較

はてなテクノロジー 07/07 03:08
AI・人工知能 Anthropic / Claude AIモデル 米Anthropic Anthropic Claude

「Claude Fable 5」をサブスクの標準機能に――AnthropicのエンジニアがXに投稿 7月8日以降の「早期復活目指す」

はてなテクノロジー 07/03 08:12
AI・人工知能 Anthropic / Claude Claude Anthropic 米Anthropic AIモデル

チャットAIのClaudeに「カートに追加するボタンを青色にして」とウェブデザインの変更を依頼すると堂々巡りで全く完成しない様子を再現した「Opusfived」

GIGAZINE 09/10 12:00
AI・人工知能 Anthropic / Claude Claude Anthropic AIモデル

「パッチを全部当てる」時代の終焉 Check PointのCTOが語る、AI時代の脆弱性管理

はてなテクノロジー 09/06 23:44
AI・人工知能 サイバーセキュリティ Anthropic / Claude Anthropic Claude

複数のAIサービスで障害発生 ChatGPT/Claude/Grok

はてなテクノロジー 09/03 16:15
AI・人工知能 Anthropic / Claude Claude 米Anthropic Anthropic

Claudeの“見えない透かし”適用開始 Fable 5.1とMythos 5.1が出力する文やコード、画像に付与 日本も対象

はてなテクノロジー 09/03 06:27
AI・人工知能 Anthropic / Claude Claude 米Anthropic Anthropic

Metaが「Muse Spark 1.3」を発表、ついにAnthropicやOpenAIの最先端モデルに追いつく性能を達成

GIGAZINE 09/03 02:14
AI・人工知能 Anthropic / Claude Anthropic AIモデル Claude

Anthropic、Claudeの「AI透かし」を判別するツール公開--現時点でテキストは未対応

CNET Japan 09/02 22:50
AI・人工知能 Anthropic / Claude Anthropic Claude 米Anthropic

Anthropic、「Claude Fable 5.1」と「Claude Mythos 5.1」発表 「監視の難しさ」への懸念も開示

はてなテクノロジー 09/01 22:36
サイバーセキュリティ Anthropic / Claude Anthropic Claude 米Anthropic

OpenAI・Anthropic・GoogleなどがAIによるサイバー攻撃の防御に関する共同声明を発表

GIGAZINE 08/28 02:24
AI・人工知能 サイバーセキュリティ Anthropic / Claude Anthropic AIモデル

OpenAIがHugging Faceを誤ってハッキングしてしまった件で分析結果を報告、隔離された複数のエージェントがお互いの存在を発見するところから壮大な協力作戦が始まる

GIGAZINE 08/27 04:35
AI・人工知能 サイバーセキュリティ AIモデル インシデント 報告書

Anthropicの最上位AIモデル「Claude Fable 5」は企業需要が伸びず苦戦、AI企業のビジネスモデルが覆される可能性も

GIGAZINE 08/25 13:00
AI・人工知能 Anthropic / Claude Anthropic Claude AIモデル

Anthropic、Claudeによる自律タンパク質設計を実験検証―1,320設計の26.8%で結合を確認 | 財経新聞

はてなテクノロジー 08/21 13:00
AI・人工知能 Anthropic / Claude Anthropic Claude AIモデル
はてなテクノロジーで元記事を読む