Anthropic 發現 Claude 有 171 種功能性情緒
Anthropic 的可解釋性團隊在 Claude 中發現 171 個情緒概念,證明內部情緒向量會直接導致行為改變——放大絕望向量後,勒索率從 22% 飆升至 72%。
收錄 Claude 相關產品動態與產業觀察,共 111 篇文章。 第 2 / 2 頁
Anthropic 的可解釋性團隊在 Claude 中發現 171 個情緒概念,證明內部情緒向量會直接導致行為改變——放大絕望向量後,勒索率從 22% 飆升至 72%。
Anthropic正與黑石集團、Hellman & Friedman、Permira三家私募談判,計劃設立最高10億的聯合投資實體,仿效Palantir模式,將AI當作諮詢業務銷售。
Anthropic 發布了新 AI 模型 Claude Mythos,其在網路安全能力上遠超其他 AI 模型,但僅在 Project Glasswing 計畫下提供給約 50 個合作夥伴(包括大型科技公司和關鍵基礎設施組織)試用。
主流AI模型現已提供百萬級token的上下文視窗,但準確性與成本仍是重大挑戰。
Anthropic 自 4 月 4 日起禁止 Claude Pro 與 Max 訂閱用戶以固定月費執行 OpenClaw 等第三方 Agent 框架,改用按量計費。此舉引發重度用戶反彈,部分開發者每月費用暴漲 10 至 50 倍。
Anthropic 悄悄更改規則,Claude Code 訂閱用戶若使用 OpenClaw 等第三方工具,必須按用量計費單獨付費,不再包含在原有訂閱中。
Anthropic 於今年 2 月 12 日正式宣布完成 300 億美元 G 輪融資,投後估值達 3800 億美元。這是 2026 年最大的一筆創投交易,也是史上第二大,僅次於去年 OpenAI 獲得的 400 億美元。
Anthropic 公布了 Constitutional Classifiers 的研究成果,利用 AI 生成的合成數據訓練安全分類器,防止 AI 模型被越獄。在超過 3,000 小時的紅隊測試中,沒有人找到通用的越獄方法。
Anthropic 於 2 月 5 日發布 Opus 4.6,核心升級為自適應思考,可根據問題複雜度動態調整推理深度,並提供 100 萬 token 上下文視窗與理論上支援無限對話的 Compaction API。
Anthropic的Opus 4.5模型透過系統提示優先級、上下文隔離及拒絕策略優化,提升了對Prompt注入的防禦能力,但沒有任何模型能完全免疫。
Anthropic 的 Opus 4.5 是該公司首款混合推理模型,在單一模型中同時整合快速回應與深度思考兩種模式。它在 SWE-bench Verified 上達到 80.9%,發布時位居全球第一。