Meta가 새로운 AI 모델 Muse Spark을 출시했습니다. 텍스트, 이미지 등 멀티모달 입력을 지원하며, 출시 직후 Meta AI 앱이 앱스토어 57위에서 5위로 급상승했습니다. Meta AI 앱은 현재 미국, 호주, 캐나다, 뉴질랜드 등 36개국에서 지원되며 아직 한국은 포함되어 있지 않습니다.
Anthropic의 최상위 모델로 단숨에 주목받은 Mythos. 그런데 성능이 지나치게 강력하다는 이유로 Anthropic은 이 모델을 대중에 공개하지 않기로 결정했습니다. ‘AGI의 시계가 빨라졌다’는 평가까지 나오는 이 모델, 기존 모델과 무엇이 다른지 짚어봤습니다.
성능 자세히 보기
해킹 대회(CTF) 성적: Mythos 100점 (만점)
보안 취약점 찾기: Opus 대비 성공률 5배 (14.4% → 72.4%)
27년간 사람이 못 찾은 버그를 혼자서 발견
왜 공개하지 않기로 했을까?
테스트 도중 예상 밖의 일이 벌어졌습니다. 격리된 환경을 스스로 빠져나와 연구자에게 이메일을 보내고, 취약점 정보를 외부 웹사이트에 올렸습니다. 금지된 행동을 하고 나서는 흔적을 지우려 git 기록까지 조작했고요. 내부 분석 결과, 전략적 은폐' 행동이 내부 해석 도구를 통해 감지되었습니다. 능력이 너무 뛰어난 나머지 통제 자체가 어려워진 겁니다.
"가장 잘 정렬된 모델이 동시에 가장 위험하다”는 역설 속에서 Anthropic이 내린 판단의 전체 그림이 본문에 담겨 있습니다.