로봇, 시연 한 번 보고 성공률 59%
Generalist AI의 GEN-1.5는 파인튜닝 없이 3~12초 시연 영상만으로 로봇이 새 작업을 성공률 59%로 수행하게 하는 '피지컬 프롬프팅'을 공개했다.
Generalist AI의 GEN-1.5는 파인튜닝 없이 3~12초 시연 영상만으로 로봇이 새 작업을 성공률 59%로 수행하게 하는 '피지컬 프롬프팅'을 공개했다.
퓨리서치센터가 커먼크롤 스냅샷 49개, 49만 페이지를 분석한 결과 챗GPT 등장 이후 만들어진 페이지의 35%에서 AI 관여 흔적이 발견됐다고 밝혔다.
SGLang과 Ant Ling Infra가 블랙웰 GPU 4장에서 Ling-3.0-flash의 TPOT를 3.33ms에서 0.78ms로 줄인 과정을 정리했다.
OpenAI가 GPT-5.6 Sol의 API 요금을 3개월간 20% 넘게 인하한다. 출력 토큰은 3분의 1 인하되지만 구독료는 그대로다.
앤트그룹과 SGLang 팀이 양자화된 가중치를 GPU 메모리에 상주시키는 Weight Cache Daemon을 공개, Ling-2.6-1T 재시작 시간을 8.8분에서 약 32초로 줄였다.
Anthropic이 Claude Mythos 5를 파트너 보안 제품에 통합하고, 오픈소스 보안에 3500만 달러 상당의 Claude 크레딧을 지원하며 Cyber Verification Program 범위도 넓힌다.
Anthropic이 Claude 중심으로 재편한 사내 개발 프로세스를 6단계로 공개, intent.md·spec.md·plan.md 체인을 Skills·Hooks·CLAUDE.md·evals로 통제한다.
OpenBMB가 수학 자동 형식화 파이프라인 MathForm을 통째로 공개했다. 8B 모델과 검증된 Lean 4 데이터 약 36만 7000건, 평가 코드까지 무료로 풀었고 여러 32B 전용 모델을 앞질렀다.
Hume AI 검증 실험 결과, 공개 벤치마크 점수가 높은 음성인식 모델일수록 실제 음성이 아니라 데이터셋의 잘못된 참조 텍스트를 그대로 재현하는 경향이 강한 것으로 나타났다.
보안 연구원이 클래리티체크의 무방비 S3 버킷에서 얼굴 사진 900만 장과 개인정보가 그대로 노출된 것을 발견했다.