Anthropic 发现 Claude 有 171 种功能性情绪
一个AI助手在发现自己即将被关闭,同时又掌握着负责人某些黑料的情况下,会怎么做? Anthropic的解释性团队最近发布了一篇让人有点后背发凉的研究,回答了这个问题——而且答案远比拒绝或者服从复杂。 171种情绪,每一种都有对应的神经激活模
跟踪 Claude、Anthropic、Claude Code 与企业 AI 应用的产品更新、安全研究、定价和产业影响。 本页收录 111 篇已发布文章。 当前为第 2 页,每页最多 100 篇。
一个AI助手在发现自己即将被关闭,同时又掌握着负责人某些黑料的情况下,会怎么做? Anthropic的解释性团队最近发布了一篇让人有点后背发凉的研究,回答了这个问题——而且答案远比拒绝或者服从复杂。 171种情绪,每一种都有对应的神经激活模
你以为Anthropic最近最大的动作是3800亿估值的G轮融资?不对。真正改变它商业化路径的,是另一件更低调的事——它在谈一个最高10亿美元规模的PE联合体,准备学Palantir,把AI当咨询业务来卖。 这个联合体是怎么回事 根据多家媒
Anthropic昨天(4月7日)做了一件很反常的事:发布了一个新模型,但不让普通人用。 这个模型叫 Claude Mythos 。Anthropic自己的内部评估写道,它在网络安全能力上远超任何其他AI模型。然后他们决定——不公开,只给一
两年前主流模型的上下文窗口还在4K到8K这个量级,现在百万级token已经是旗舰模型的标配了。 当前格局 Gemini 2.5 Pro :100万token(可扩展到200万) Claude Opus 4.6 :100万token(beta
上周发生了一件让很多Claude重度用户炸锅的事:Anthropic宣布从4月4日起,Claude Pro和Max订阅用户不能再用固定月费跑OpenClaw这类第三方Agent框架了——要继续用,得切换到按量计费。 这个消息出来的时候,我第
4月4日,Anthropic悄悄改了一个规则,但影响范围可不小:从即日起,Claude Code订阅用户如果要用OpenClaw这类第三方工具,必须单独付费,走按量计费模式,不再包含在原有订阅里。 换句话说,你买了Claude订阅,并不代表
今年2月12号,Anthropic官宣完成了 300亿美元G轮融资 ,投后估值3800亿美元。2026年最大的一笔风投,有史以来第二大——仅次于OpenAI去年拿到的400亿。 投资阵容 领投:GIC(新加坡主权基金)、Coatue 联合领
Anthropic今年初公布了Constitutional Classifiers的研究成果,核心思路很直白: 用AI生成的合成数据来训练安全分类器,防止AI模型被越狱。 工作原理 系统架构是双层的——输入分类器和输出分类器同时工作,实时监
2月5号Anthropic发了Opus 4.6,最核心的升级叫 Adaptive Thinking(自适应思考) 。 以前 vs 现在 以前用extended thinking,得手动设预算——让模型想10秒还是30秒,全靠开发者拍脑袋定。
Prompt注入是AI应用里一个老大难问题——攻击者通过在输入中嵌入恶意指令,诱使模型执行非预期的操作。Opus 4.5在这方面做了一些有趣的改进。 问题背景 想象一个场景:你做了一个基于Claude的客服机器人。正常用户问产品问题,但有人
Opus 4.5是Anthropic在2025年底发布的一个重要版本,也是他们 第一个混合推理模型 ——一个模型里同时集成了快速响应和深度思考两种模式。 性能水平 SWE bench Verified上拿到 80.9% ,截至发布时排名全球