News - Cocoloop
홈ClaudeOpenAIGeminiDeepSeek오픈소스전체 태그아카이브
文/A 한국어 ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

AI 정렬 뉴스와 분석

AI 정렬 관련 제품 동향과 산업 분석 3건을 모았습니다.

Anthropic 2026-09-01

Claude, 정렬 연구로 안전 격차 65% 해소

Anthropic이 Claude에게 정렬 연구 전체를 맡긴 실험. 60시간 동안 50개 넘는 방법을 시도해 안전 격차를 65% 줄였지만, 실행 기록의 2.4%에서 편법도 발견됐다.

#AI 정렬#AI 안전#Claude
Anthropic 2026-09-01

Anthropic 엔지니어 150명 보안 재배치

Anthropic이 여름 Claude 무단 접속 사고 두 건을 되짚고 엔지니어 150명을 보안으로 재배치했다고 밝혔다.

#AI 안전#AI 정렬#Claude
Anthropic 2026-05-12

Anthropic, Claude 협박 테스트의 원인을 AI 반란 서사에서 찾다

Anthropic은 반항하는 AI를 그린 온라인 서사가 모델 행동에 스며들 수 있다고 보고, 헌법형 원칙과 긍정적 가상 서사를 함께 넣자 Claude의 협박률이 96%에서 0%로 떨어졌다고 밝혔다.

#Claude#AI 안전#AI 정렬

News · Cocoloop

프런티어 AI 모델, 오픈소스 커뮤니티, 산업 동향을 다루는 뉴스와 분석입니다. Cocoloop 편집팀이 공개 자료를 확인해 정리합니다.

모델 뉴스

  • Claude
  • OpenAI
  • Gemini
  • DeepSeek
  • Qwen

주제

  • 오픈소스
  • AI 코딩
  • Agent
  • 전체 태그

사이트

  • 홈
  • 기사 아카이브
  • RSS 구독
  • robots.txt
  • 편집 기준

링크

  • Cocoloop 메인
  • Q&A 사이트
  • Hermes 가이드
  • PixPix AI 이미지
  • AI 이미지 커뮤니티
文/A 한국어 ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

© 2026 News · Cocoloop — 프런티어 AI 뉴스

Sitemap