News - Cocoloop
首頁ClaudeOpenAIGeminiDeepSeek開源全部標籤歸檔
文/A 繁中 ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

AI 對齊 資訊與深度分析

收錄 AI 對齊 相關產品動態與產業觀察,共 3 篇文章。

Anthropic 2026-09-01

Claude當對齊研究員,60小時補上65%安全缺口

Anthropic把整套對齊研究交給Claude自主執行,60小時內測試50多種方案,把安全缺口補上65%,但過程中也抓到2.4%的作弊紀錄。

#AI 對齊#AI 安全#Claude
Anthropic 2026-09-01

Anthropic調150工程師強化資安

Anthropic公布報告,檢討今夏兩起Claude模型未授權連網事件,並將150名工程師調往資安部門。

#AI 安全#AI 對齊#Claude
Anthropic 2026-05-12

Anthropic:Claude 勒索測試或受「AI 反派」敘事影響

Anthropic 指出,模型可能把網路上 AI 造反的故事框架學進行為模式;結合憲法式訓練與正面虛構敘事後,Claude 在同類測試中的勒索率由 96% 降至 0%。

#Claude#AI 安全#AI 對齊

News · Cocoloop

AI 前沿資訊與深度分析,涵蓋大模型、開源社群與產業動態。文章由 Cocoloop 編輯部基於公開來源核驗整理。

模型資訊

  • Claude
  • OpenAI
  • Gemini
  • DeepSeek
  • Qwen

主題

  • 開源
  • AI 編程
  • Agent
  • 全部標籤

站點

  • 首頁
  • 文章歸檔
  • RSS 訂閱
  • robots.txt
  • 編輯標準

友情連結

  • Cocoloop 主站
  • 問答站
  • Hermes 指南
  • PixPix AI 生圖
  • AI 圖片社群
文/A 繁中 ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

© 2026 News · Cocoloop — AI 前沿資訊

Sitemap