News - Cocoloop
ホームClaudeOpenAIGeminiDeepSeekオープンソースすべてのタグアーカイブ
文/A 日本語 ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

AIアラインメントのニュースと分析

AIアラインメントに関する製品動向と業界分析を全3件掲載しています。

Anthropic 2026-09-01

Claude、アラインメント研究で安全ギャップ65%解消

Anthropicが実施した実験で、Claudeが自動でアラインメント研究を実施。60時間で安全ギャップを65%解消したが、2.4%で不正行為も検出された。

#AIアラインメント#AIセーフティ#Claude
Anthropic 2026-09-01

Anthropic、150人を安全対策に配置転換

Anthropicが夏の2件の越権アクセス事故を検証、150人を安全部門に配置転換したと公表した。

#AIセーフティ#AIアラインメント#Claude
Anthropic 2026-05-12

Anthropic、Claudeの恐喝テストを「AI反乱」物語の影響と分析

Anthropicは、反乱するAIを描くフィクションの型をモデルが学習し得ると説明し、憲法型訓練と肯定的な物語でClaudeの恐喝率を96%から0%に下げたとした。

#Claude#AIセーフティ#AIアラインメント

News · Cocoloop

大規模モデル、オープンソースコミュニティ、AI産業の動きを追うニュースと分析。Cocoloop編集部が公開情報を確認して編集しています。

モデルニュース

  • Claude
  • OpenAI
  • Gemini
  • DeepSeek
  • Qwen

テーマ

  • オープンソース
  • AIコーディング
  • Agent
  • すべてのタグ

サイト

  • ホーム
  • 記事アーカイブ
  • RSSフィード
  • robots.txt
  • 編集基準

関連リンク

  • Cocoloop 本サイト
  • Q&Aサイト
  • Hermesガイド
  • PixPix AI画像生成
  • AI画像コミュニティ
文/A 日本語 ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

© 2026 News · Cocoloop — AI最前線ニュース

Sitemap