Anthropic, 대화 25만 건을 외부 연구진에 공개
Anthropic이 실제 대화 25만 건을 스탠퍼드·옥스퍼드·METR에 분석하게 하고 임페리얼 칼리지 런던이 프라이버시 감사를 맡았다. 결과는 통념과 어긋난다.
AI 연구 관련 제품 동향과 산업 분석 23건을 모았습니다.
Anthropic이 실제 대화 25만 건을 스탠퍼드·옥스퍼드·METR에 분석하게 하고 임페리얼 칼리지 런던이 프라이버시 감사를 맡았다. 결과는 통념과 어긋난다.
Hume AI 검증 실험 결과, 공개 벤치마크 점수가 높은 음성인식 모델일수록 실제 음성이 아니라 데이터셋의 잘못된 참조 텍스트를 그대로 재현하는 경향이 강한 것으로 나타났다.
필즈상 수상자 테렌스 타오가 AI가 만들어내는 증명이 수학계의 동료 심사 체계를 압도할 것이라 경고하며, 발표와 교육에 관한 새 규범을 제안하는 논문을 냈다.
프라임 인텔렉트가 18개 프런티어 모델에 AI 연구를 맡긴 153회 완전 자율 실험 결과를 공개했다. 1위 모델은 인간 기록과의 격차 82%를 좁혔지만, 새로운 방법을 내놓은 모델은 하나도 없었다.
Anthropic이 공개한 실험에서 Claude가 15개 단백질 표적 중 14개에서 유효한 결합체를 설계했으며, Adaptyv Bio와 Twist Bioscience가 검증했다.
Aureka Biotechnologies가 1억 달러 시리즈 B를 조달해 생물 기반 모델과 습식 실험 피드백 루프를 강화한다.
Anthropic은 미공개 연구용 Claude가 리만 제타 영점 관련 하한을 41.6%에서 67.2%로 높였다고 밝혔다.
BigBang-V1은 합성 데이터를 에이전트가 문제를 만들고 풀고 검증하는 루프로 바꾼다.
OpenAI는 Astra의 첫 공개 신호로 수학과 이론 컴퓨터과학의 10개 결과, 249쪽 논문, Lean 증명서와 추론 기록을 공개했다.
Google ATLAS는 Gemini 상호작용 1,465만 건을 분석해 AI 도입은 넓지만 업무 자동화 깊이는 아직 얕다고 밝혔다.
MIT·케임브리지·프린스턴 등의 Nature 연구는 사람이 낯선 게임을 깊은 탐색보다 빠르고 얕은 목표 지향 시뮬레이션으로 이해한다는 단서를 제시했다.
Oak Lab은 지속 학습 에이전트를 위해 20와트 목표를 제시했다. 이 글은 확인된 사실과 단일 발표를 넘어서는 의미를 정리한다.
GPT-5.6, 그래프 이론 증명 제시. 확인된 사실과 그 뒤의 산업적 신호를 간결하게 정리한다.
ICML 2026, 최우수 논문 두 편을 확산 연구에 수여 소식을 한국 기술 독자를 위해 핵심 숫자와 검증 지점을 살려 정리했습니다.
Anthropic, 연구실용 Claude Science 출시. 발표와 보도의 핵심, 주요 수치, 회사 측 설명, 시장적 의미를 자연스러운 뉴스 문체로 정리했다.
Anthropic, 감사 가능한 Claude Science 제시。
이번 움직임은 모델이나 도구 자체보다 자금, 고객 도입, 규제 대응이 경쟁력을 가르는 단계로 들어섰다는 신호다.
OpenAI는 모든 것을 완전히 자동화하는 미래를 원하지 않는다고 밝히며 자율 AI 연구자 표현에서 사람과 함께 일하는 방향으로 옮겼다.
강화학습 선구자는 다음 단어 예측 모델에 인과, 실험, 자기 경험이 부족하다고 지적한다.
DeepMind의 Aletheia가 멀티 에이전트 프레임워크를 기반으로 FirstProof 챌린지의 미발표 연구 수준 수학 문제 10개 중 6개를 해결했으며, 그중 5개는 외부 전문가로부터 '출판 가능' 평가를 받았습니다.
페이페이 리의 World Labs, 공간 지능에 베팅. 발표 내용과 전략적 맥락, 영향을 받는 이용자와 기업의 실질적 위험을 정리한다.
Google이 NotebookLM을 Gemini의 주요 워크플로우에 직접 통합하는 새로운 Notebooks 기능을 발표했습니다. 사용자는 개인 지식 소스를 관리하고 두 제품 간에 동기화할 수 있습니다.
Yann LeCun이 AMI Labs를 설립하고 10억 3000만 달러의 시드 라운드를 기업가치 35억 달러에 마감했다. 다음 토큰 예측에 의존하지 않는 AI를 만들겠다는 비전 아래 JEPA 아키텍처를 기반으로 세계 모델을 개발한다.