AI 소식 · 영상 게시 2026-09-21 · 7분 07초

Fable 5.2 비공개 그레이 테스트 소문 정리와 읽는 법

2026년 9월 Anthropic이 공지 없이 Fable 5.2를 일부 사용자에게 시험했다는 관찰과 커뮤니티 테스트, 함께 돈 유출 주장을 정리하고 걸러 읽을 지점을 짚었습니다.

이 영상에서 단테는 2026년 9월 19~20일 무렵 커뮤니티에 돌던 이야기, 즉 Anthropic이 공식 문서에 없는 Fable 5.2를 일부 사용자에게 몰래 시험하고 있었다는 소문과 그 주변 반응을 정리합니다. 아래 내용은 영상 게시 시점(2026-09-21) 기준으로 공개된 발표가 아니라 사용자 관찰과 유출 주장을 모은 것입니다. 모델 출시 전후에 나오는 소문을 어떻게 걸러 읽어야 하는지 감을 잡고 싶은 분에게 참고가 됩니다.

무엇이 관찰됐나: 조용한 그레이 테스트

이야기의 출발점은 Claude Code나 Chat, Cowork에서 Fable 5.1을 쓰고 있다고 생각한 사용자 중 일부가 실제로는 Fable 5.2의 응답을 받고 있었다는 주장입니다. 공지 없이 일부 요청을 새 체크포인트로 보내는 그레이 테스트였다는 것이고, 원래는 아무도 몰라야 했는데 출력의 성격이 달라진 것을 테스터들이 눈치채면서 알려졌다고 영상은 설명합니다.

이를 눈치챈 사람들은 밤새 스트레스 테스트를 돌렸습니다. 한 테스터는 같은 프롬프트를 높은 추론 모드로 Fable 5.1, Fable 5.2, Astra에 나란히 넣어 비교했고, 5.2가 이전 Fable보다 크게 도약했으며 Astra와 대등하게 맞선다고 평가했습니다. 여러 모드에서 격차가 유지됐다는 주장도 덧붙였습니다.

다만 같은 테스터는 대가도 솔직하게 적었습니다. 일관성과 장문 추론의 한계를 넘기 위해 훨씬 깊고 느리게 생각하는 만큼 생성이 느려지고 추론 비용이 올라간다는 것입니다. 성능 향상이 공짜로 오지 않는다는 점은 이후 실제 출시 모델을 평가할 때도 기억해 둘 만합니다.

커뮤니티에서 돌린 테스트들

영상에서 소개한 사례는 다음과 같습니다.

  • 게임 클론: 한 사용자가 5.2에게 브롤스타즈 클론을 맡기고 한 시간 뒤 결과물을 올려 게임 개발자들 사이에서 화제가 됐습니다.
  • 로켓 테스트: 복잡한 물리 계산, 공간 논리, 전체 엔지니어링 시스템 설계를 한 프롬프트에 몰아넣는 테스트입니다. 환각과 논리 오류를 끌어내기 좋은 시험이라 자주 쓰이는데, 그레이 테스트 중인 모델에서 환각이 이전 버전보다 훨씬 적고 결과가 사실적이라는 반응이 나왔습니다.
  • 세 모델 비교: 한 사용자는 Fable 5.2, 내부 코드명 Opus Next로 불린 모델, Astra를 최대 토큰과 가장 깊은 추론 단계로 돌렸고, Anthropic 모델 둘 다 Astra보다 눈에 띄게 좋았다고 주장했습니다.
  • 테스트 그룹 확인 요령: 웹 검색을 끈 채 최근 사실을 묻는 질문을 던져, 학습 범위가 더 최근까지 닿아 있으면 새 모델일 가능성이 높다고 보는 방법입니다. 영상에서도 확정이 아니라 요령일 뿐이라고 말합니다.

테스트 중단과 재개, 모델 선택기의 변화

Roblox Studio에서 3D 환경 작업을 하던 한 인플루언서는 Opus 쪽 테스트 모델이 Fable 5.1과 Astra보다 낫고, 더 싸고 빠르며, 시키지 않은 가이드 투어 기능까지 알아서 추가했다고 평가했습니다. 그런데 자정 무렵 예고 없이 테스트 그룹의 활성 계정이 0으로 떨어졌고, 그는 작업을 망치지 않으려고 프로젝트를 급히 멈췄다고 합니다.

몇 시간 뒤 테스트가 더 큰 규모로 돌아왔다는 이야기가 이어졌습니다. Claude Code를 넘어 Chat과 Cowork 인터페이스 전체로 확대됐다는 것이고, 이를 출시 직전 마지막 테스트 라운드로 해석하는 사람도 있었습니다. 같은 시기 공식 모델 선택기에서 Opus가 Fable 위, 맨 꼭대기로 올라간 것도 관찰됐습니다. 영상은 플래그십 모델 두 개의 순서가 바뀐 것을 가볍게 넘길 디테일이 아니라고 봅니다.

Opus 쪽 유출은 이후 5.2가 아니라 5.5로 넘어갔다는 이야기도 있습니다. 9월 20일 기사 중에는 Anthropic이 Fable 5.2와 Opus 5.5를 함께 시험하고 있다고 적은 곳이 있었고, 영상은 Fable 5.2를 9월 중순에 잠깐 관측된 체크포인트로 정리합니다.

소문을 읽는 법

영상이 이번 주를 이상하다고 보는 이유는 주요 연구소 어디도 공식 출시를 발표하지 않았는데 여러 프론티어 모델이 동시에 다른 이름을 달고 비공개 테스트에 들어갔다는 점입니다. 여러 회사의 모델이 기존 이름이나 하위 모델 이름을 빌려 돌아다닌다는 이야기가 함께 돌았습니다.

일부 프론티어 모델의 추론이 밀레니엄 난제 수준에 닿았고 개발팀이 수학자들에게 연락하고 있다는 소문도 소개하지만, 단테는 이 부분은 걸러 들어야 한다고 분명히 말합니다. 결국 출시 시점을 예측하는 사람들이 기대는 것은 패턴 매칭이며, Fable 5.1의 그레이 테스트가 공식 출시 전날 끝났던 전례 같은 과거 흐름을 근거로 삼는다는 것이 영상의 결론입니다.

이런 소식을 볼 때는 직접 확인된 관찰(출력 성격 변화, 모델 선택기 순서 변화)과 개인의 평가(어느 모델이 더 낫다), 출처가 불분명한 주장(파라미터 규모, 수학 난제)을 나눠 읽는 습관이 필요합니다.

정리

  • 영상 게시 시점(2026-09-21) 기준으로 Fable 5.2는 공식 발표 없이 일부 사용자에게 그레이 테스트된 것으로 관측됐습니다.
  • 커뮤니티 테스트에서는 Astra와 대등하거나 낫다는 평가가 나왔지만, 더 깊고 느린 추론으로 비용과 지연이 늘어난다는 지적도 함께 나왔습니다.
  • 테스트 그룹이 한때 0으로 줄었다가 Chat과 Cowork까지 확대되어 돌아왔고, 모델 선택기에서 Opus가 맨 위로 올라간 것이 관찰됐습니다.
  • Opus 쪽 유출은 5.5로 이어졌고, Fable 5.2와 Opus 5.5를 함께 시험 중이라는 보도도 있었습니다.
  • 수학 난제 해결 같은 강한 주장은 근거가 약하므로, 관찰·평가·소문을 구분해서 읽어야 합니다.

영상: 유튜브에서 보기 · 정정 요청: dante@quokkalabs.net