News - Cocoloop
首页ClaudeOpenAIGeminiDeepSeek开源全部标签归档
文/A 简中 ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

可解释性 资讯与深度分析

收录 可解释性 相关 AI 新闻、产品动态和产业观察。 本页收录 2 篇已发布文章。

Anthropic 2026-07-07

Anthropic 找到 Claude 静默工作区

Anthropic 把 Claude 的一部分“没说出口的想法”抓了出来。 这不是又一次模型人格测试,也不是让聊天机器人自称有意识。Anthropic 7 月 6 日发布的研究说,团队在 Claude 内部找到一小组特殊神经表征:它们会承载

#Claude#AI安全#可解释性
Anthropic 2026-04-08

Anthropic 发现 Claude 有 171 种功能性情绪

一个AI助手在发现自己即将被关闭,同时又掌握着负责人某些黑料的情况下,会怎么做? Anthropic的解释性团队最近发布了一篇让人有点后背发凉的研究,回答了这个问题——而且答案远比拒绝或者服从复杂。 171种情绪,每一种都有对应的神经激活模

#Claude#AI安全#可解释性

News · Cocoloop

AI前沿资讯与深度分析,覆盖大模型、开源社区、产业动态。文章由 Cocoloop 编辑部基于公开来源核验整理。

模型资讯

  • Claude
  • OpenAI
  • Gemini
  • DeepSeek
  • Qwen

主题

  • 开源
  • AI编程
  • Agent
  • 全部标签

站点

  • 首页
  • 文章归档
  • RSS 订阅
  • robots.txt
  • 编辑标准

友情链接

  • Cocoloop 主站
  • 问答站
  • Hermes 指南
  • PixPix AI生图
  • AI图片社区
文/A 简中 ▾
简体中文 Simplified Chinese English English 日本語 Japanese 한국어 Korean 繁體中文 Traditional Chinese Bahasa Indonesia Indonesian Tiếng Việt Vietnamese Deutsch German Português Portuguese Español Spanish Français French

© 2026 News · Cocoloop — AI前沿资讯

Sitemap