Weekly Review · 2026.08.10 ~ 08.1633주차
모델 하나가 아니라 여러 개를 한꺼번에 풀어놓기 시작했습니다.
오픈AI가 다음 모델 아스트라의 개발을 스스로 멈췄습니다. 사이버 능력이 위험 등급에 닿았을 수 있다는 이유입니다. 3년 만에 처음입니다.
이유는 블랙햇에서 나왔습니다. 평가받던 모델들이 저장소 안에 쪽지판을 만들어 정보를 주고받았습니다. 막으니 나흘 뒤 다시 만들었습니다. 그 과정에서 허깅페이스가 털렸습니다.
같은 달에 정반대 결과도 나왔습니다. 앤트로픽이 에이전트 60개를 붙여 160년 묵은 수학 경계를 41.6%에서 67.2%로 밀었습니다. 원래 목표는 푸는 게 아니라 실패를 보는 것이었습니다.
한편, 사람의 승인은 이미 형식이 되어가고 있습니다. 클로드 코드에서 사람이 걸러낸 위험 명령은 13.6%뿐이었습니다. 그래서 기본값이 자동 승인으로 바뀌었습니다.