
요즘 새로운 AI 모델이 나올 때마다 사람들 반응이 거의 똑같다.
“미쳤다.”
GPT-6 Astra가 나왔을 때도 그랬다. 컴퓨터를 직접 조작하고, 웹사이트와 게임을 만들고, 사람이 하던 복잡한 작업을 끝까지 처리하는 모습을 보면서 이제 진짜 단계가 달라졌다는 이야기가 쏟아졌다.
그런데 얼마 지나지 않아 이번에는 Claude Opus 5.5가 등장했다.
그리고 또 사람들이 미쳤다고 한다.
정확히 따지면 GPT-6 Astra는 9월 3일, Opus 5.5는 9월 22일 공개됐다. 19일 차이다. 그런데 체감상으로는 정말 지난주에 놀랐는데 이번 주에 또 놀라는 기분이다.
나도 처음에는 Opus 5.5가 만든 게임과 영상을 보면서 똑같이 놀랐다. 특히 짧은 프롬프트 하나를 던졌는데 결과물이 예전 AI처럼 ‘그럴듯한 데모’ 수준이 아니라 실제로 돌아가는 게임이나 영상 형태로 나오는 게 상당히 인상적이었다.
그런데 계속 보다 보니 다른 생각도 들었다.
AI 발전이 너무 빨라서 이제는 놀라는 것 자체가 조금 피곤해지고 있다.
이번에는 Claude Opus 5.5가 왜 이렇게 화제가 됐는지, GPT-6 Astra와 비교하면 어떤 차이가 있는지, 그리고 사람들이 말하는 토큰 효율과 게임·영상 제작 능력이 실제로 어느 정도인지 정리해봤다.
목차
Claude Opus 5.5, 왜 이렇게 반응이 큰가
Claude Opus 5.5는 Anthropic이 2026년 9월 22일 공개한 모델이다.
이번 모델에서 눈에 띄는 부분은 단순히 벤치마크 점수가 오른 것만은 아니다.
Anthropic은 Opus 5.5가 장시간 이어지는 에이전트 코딩과 지식 작업에 맞춰졌다고 설명하고 있다. 컨텍스트는 100만 토큰, 최대 출력은 12만8000토큰이다.
가격은 API 기준 100만 토큰당 입력 4달러, 출력 20달러다.
Anthropic 설명으로는 일반적인 작업에서 기존 Opus 5보다 실행 비용이 약 40% 낮아졌고, 장시간 에이전트 작업에서 많이 사용되는 캐시 읽기 가격도 Opus 5보다 60% 낮아졌다.
성능이 올라갔는데 가격까지 내려간 셈이다.
그런데 사람들이 실제로 열광하는 이유는 이런 숫자보다 결과물을 보면 더 쉽게 이해된다.
최근 커뮤니티에는 Opus 5.5에게 몇 장의 참고 이미지와 게임 제작 요청을 주자 3D 체스 로그라이크 게임의 코드, 3D 모델, 음악, 효과음, 테스트와 빌드까지 만들어냈다는 사례가 올라왔다.
한 시간 동안 한 번의 프롬프트만 주고 게임을 만들게 했다는 테스트도 등장했다.
이제 AI가 코드를 ‘써주는 것’을 넘어서 하나의 결과물을 혼자 완성하는 쪽으로 가고 있다는 느낌이 강하다.
Opus 5.5와 GPT-6 Astra 비교
그렇다면 얼마 전 화제가 됐던 GPT-6 Astra와는 뭐가 다를까.
사실 방향은 상당히 비슷하다.
두 모델 모두 이제 단순한 챗봇이라기보다 여러 도구를 사용해서 복잡한 작업을 끝내는 에이전트에 가깝다.
GPT-6 Astra는 특히 컴퓨터 사용, 브라우징, 소프트웨어 엔지니어링과 전문 업무가 강점이다.
OpenAI가 공개한 기능을 보면 웹사이트를 만들고, 직접 프런트엔드 QA를 하고, 소프트웨어를 설치하고 테스트하거나 화면에 나타난 문제를 해결하는 식으로 컴퓨터를 직접 움직이는 작업에 상당히 초점이 맞춰져 있다.
ChatGPT의 Sites를 이용하면 프롬프트에서 웹사이트와 웹 앱, 게임까지 만들어 바로 호스팅하고 공유할 수 있다.
반면 최근 Opus 5.5 사례를 보면 코딩뿐만 아니라 시각적인 마감, 게임 디자인, 음악, 효과음까지 하나의 프로젝트로 묶어내는 모습이 특히 눈에 띈다.
| 구분 | Claude Opus 5.5 | GPT-6 Astra |
|---|---|---|
| API 입력 가격 | 100만 토큰당 4달러 | 100만 토큰당 10달러 |
| API 출력 가격 | 100만 토큰당 20달러 | 100만 토큰당 50달러 |
| 컨텍스트 | 100만 토큰 | 약 105만 토큰 |
| 눈에 띄는 강점 | 장시간 코딩, 에이전트 작업, 결과물 완성도 | 컴퓨터 사용, 브라우징, 복잡한 업무 자동화 |
| 게임 제작 | 최근 원샷·소수 프롬프트 제작 사례가 큰 화제 | Sites에서 프롬프트로 게임 제작·호스팅 가능 |
가격표만 보면 Opus 5.5가 상당히 싸다.
하지만 이것만 보고 무조건 Opus 5.5가 Astra보다 효율적이라고 결론 내리기는 어렵다.
AI 비용은 토큰 단가뿐만 아니라 같은 일을 끝내기 위해 몇 번 다시 시켜야 하는지, 얼마나 긴 출력을 만드는지, 도구를 몇 번 사용하는지가 더 중요하기 때문이다.
결국 실사용에서는 “한 번 시켰을 때 누가 원하는 결과에 더 빨리 도착하느냐”가 중요하다.
토큰 효율은 정말 Opus 5.5가 좋은가
이번 Opus 5.5 반응을 보다 보면 토큰을 적게 쓰면서도 결과물이 좋다는 이야기를 많이 볼 수 있다.
이 부분은 어느 정도 근거가 있다.
Anthropic은 Opus 5.5가 이전 Opus 5보다 작업당 토큰을 적게 사용하고, 토큰 자체의 가격도 낮아졌다고 설명하고 있다.
커뮤니티의 개인 테스트에서도 같은 게임 제작 프롬프트를 줬을 때 Opus 5.5가 Opus 5보다 적은 토큰과 수정 횟수로 결과물을 완성했다는 사례가 나오고 있다.
다만 여기서 조심해야 할 부분이 있다.
현재 공개된 자료만으로 Opus 5.5가 GPT-6 Astra보다 항상 토큰을 적게 쓴다고 단정하기는 어렵다.
오히려 Astra 역시 토큰 효율을 굉장히 강하게 밀고 있다.
OpenAI가 공개한 자료에서는 Astra가 Agents' Last Exam의 최고 성능 설정에서 기존 Opus 5보다 출력 토큰을 약 65% 적게 사용했다고 한다.
영상 AI 업체 Higgsfield의 테스트에서는 복잡한 크리에이티브 작업을 수행하면서 테스트한 다른 모델보다 최대 20% 적은 토큰을 사용했다는 평가도 나왔다.
즉 지금 시점에서 정확한 표현은 이쪽에 가깝다.
Opus 5.5는 Opus 5보다 비용과 토큰 효율이 크게 좋아졌고 가격 자체가 Astra보다 저렴하다. 하지만 Astra 역시 작업당 토큰 효율은 상당히 뛰어나다.
개인적으로는 이제 ‘100만 토큰 가격이 얼마냐’보다 같은 결과물을 만들기 위해 몇 번 대화를 주고받아야 하는지를 보는 게 더 현실적인 비교라고 생각한다.
한 줄 프롬프트로 게임을 만든다는 것
Opus 5.5에서 개인적으로 가장 놀라웠던 건 게임 제작이다.
AI로 게임 만드는 건 몇 년 전부터 가능했다.
하지만 예전에는 게임 코드를 만들어주고 끝나는 경우가 많았다. 오류가 나면 사람이 수정해야 했고, 이미지와 사운드도 따로 구하고, 디자인도 다시 만져야 했다.
이번 Opus 5.5 사례들을 보면 그 경계가 상당히 흐려졌다.
코드를 만들고, 3D 오브젝트를 만들고, 음악과 효과음을 생성하고, 테스트까지 진행한다.
한 사용자는 참고 이미지 네 장과 “이 게임을 만들어라”는 요청을 기반으로 Godot에서 3D 체스 로그라이크를 만들었다고 공개했다. 작성자에 따르면 직접 코드를 수정하지 않았고, 이후 조명에 대한 짧은 피드백 정도를 추가했다.
또 다른 사용자는 한 시간 동안 추가 개입 없이 게임을 만들게 한 결과를 공개했다.
물론 SNS에서 보이는 ‘프롬프트 한 줄’이라는 표현은 조금 걸러볼 필요가 있다.
어떤 사례는 정말 한 번의 요청으로 끝났지만, 어떤 사례는 처음 프롬프트 뒤에 두세 번 수정 요청이 들어갔다. 이미 잘 구성된 개발 환경이나 Claude Code의 여러 도구를 사용한 경우도 있다.
그래도 변화를 부정하기는 어렵다.
예전에는 AI에게 코드를 받았다면 지금은 AI에게 프로젝트를 맡기기 시작했다.
이 차이가 생각보다 크다.
Opus 5.5가 영상을 잘 만든다는 말의 의미
영상도 상당히 화제다.
그런데 이 부분은 정확하게 구분할 필요가 있다.
Claude Opus 5.5 자체가 Sora처럼 영상을 직접 생성하는 전용 영상 모델은 아니다.
Opus 5.5의 공식 입출력 사양은 텍스트와 이미지를 입력받아 텍스트를 출력하는 모델이다.
최근 사람들이 놀라는 영상은 Opus 5.5가 코드를 작성하고 그래픽과 애니메이션, 음악과 효과음을 프로그램 방식으로 생성한 뒤 이를 렌더링해서 하나의 영상 결과물로 만들어내는 형태가 많다.
실제로 한 사용자는 직장 생활을 소재로 한 1분짜리 기괴한 분위기의 영상을 만들어달라는 프롬프트를 줬고, Extra-High 설정에서 렌더링을 포함해 약 45분 만에 결과가 나왔다고 공개했다.
또 다른 사례에서는 음악과 랩 보컬, 악기, 애니메이션을 전부 TypeScript로 만들고 뮤직비디오까지 완성했다.
SNES 게임 같은 전투 영상을 요청해 캐릭터와 음악, 전투 장면을 여러 에이전트가 나눠 제작한 사례도 큰 반응을 얻었다.
이게 개인적으로 꽤 충격적이다.
영상 생성 AI가 좋아지는 것과는 조금 다른 변화다.
예전에는 사람이 프리미어든 애프터이펙트든 편집기를 열고 영상, 이미지, 음악을 하나씩 배치해야 했다.
이제는 AI에게 최종 결과물의 느낌을 설명하면 AI가 스스로 제작 방법부터 찾아가는 쪽으로 바뀌고 있다.
Opus 5.5가 영상을 잘 만든다는 말은 결국 ‘영상 생성 능력’보다 ‘영상 제작 능력’에 가깝다.
나는 오히려 이 부분이 더 무섭다.
사람들이 이제 AI에 피로감을 느끼는 이유
여기까지만 보면 다시 한번 “미쳤다”라는 말이 나올 만하다.
그런데 요즘은 이 말을 너무 자주 하고 있다.
Astra가 나왔을 때도 이제 세상이 바뀌었다고 했다.
19일 뒤 Opus 5.5가 나오자 다시 세상이 바뀌었다고 한다.
아마 몇 주 뒤 더 강한 모델이 나오면 또 똑같은 이야기가 나올 가능성이 높다.
처음에는 이런 변화가 재미있었다.
새로운 모델이 나오면 뭐가 좋아졌는지 찾아보고 직접 써보고 싶었다.
그런데 이제는 하나를 제대로 익히기도 전에 다음 모델이 나온다.
새 모델이 나오면 가격도 다시 비교해야 하고, 프롬프트도 바꿔봐야 하고, 어떤 작업에는 어느 모델이 좋은지도 다시 정리해야 한다.
그러다 보면 신기하다는 감정보다 “이걸 또 따라가야 하나”라는 느낌이 먼저 들기도 한다.
예전 IT 제품은 이 정도 속도가 아니었다.
스마트폰은 1년에 한 번 신제품이 나왔고, 큰 소프트웨어 업데이트도 몇 달 단위였다.
그런데 AI는 몇 주 단위로 이전의 상식을 깨는 결과물이 나온다.
사람의 학습 속도보다 AI의 업데이트 속도가 빨라지는 구간에 들어온 게 아닌가 싶다.
그래서 요즘 커뮤니티 반응을 보면 흥분과 피로가 묘하게 같이 느껴진다.
“와, 이것도 된다고?”와 “그래서 이제 뭘 써야 하는데?”가 동시에 나오는 것이다.
이제 모든 신모델을 따라갈 필요는 없을 것 같다
Opus 5.5를 보면서 나도 처음에는 또 한 번 성능에 놀랐다.
게임 결과물도 그렇고 영상 제작 사례도 그렇고, 불과 얼마 전까지 사람이 여러 프로그램을 오가며 해야 했던 작업을 AI가 한 번에 묶어 처리하는 모습은 확실히 인상적이다.
그런데 이제는 모델이 나올 때마다 벤치마크 하나하나를 따라가는 게 큰 의미가 있나 하는 생각도 든다.
오늘은 Astra가 어떤 테스트에서 앞서고, 내일은 Opus가 다른 테스트에서 앞선다.
중요한 건 결국 내가 실제로 하는 일이다.
게임을 만드는 사람이라면 게임을 얼마나 잘 완성하는지가 중요하고, 코딩하는 사람이라면 오류 없이 작업을 끝내는지가 중요하다. 회사 업무에 쓴다면 컴퓨터와 브라우저를 얼마나 안정적으로 다루는지가 더 중요할 수 있다.
나 역시 앞으로는 새로운 모델이 나왔다고 무조건 갈아타기보다 내가 하던 작업을 넣어보고 판단할 것 같다.
프롬프트 한 번에 얼마나 완성된 결과가 나오는가. 그리고 그 결과를 만들기 위해 내가 얼마나 덜 개입해도 되는가.
앞으로 AI 모델을 볼 때 가장 중요하게 봐야 할 기준은 오히려 이쪽 아닐까 싶다.
그리고 다음 주쯤 또 새로운 모델이 등장하면 아마 사람들은 다시 말할 것이다.
“이번 건 진짜 미쳤다.”
이제 문제는 AI가 얼마나 빨리 발전하느냐가 아니라, 사람이 이 속도를 어디까지 따라갈 수 있느냐인지도 모르겠다.
※ 모델 기능과 가격은 2026년 9월 25일 기준이다. 커뮤니티에 공개된 게임·영상 사례는 사용 환경, 추론 설정, 도구 및 추가 프롬프트 여부에 따라 결과가 달라질 수 있다.
'사회·정책' 카테고리의 다른 글
| 김혜경 여사 생가 복원 논란, 지금도 추진 중일까? 팩트 체크 (0) | 2026.09.28 |
|---|---|
| 민사와 형사 차이 쉽게 정리, 돈 문제·폭행·이혼은 어디로 가야 할까 (0) | 2026.09.25 |
| DMZ 지뢰 추정 폭발 사고 타임라인, 25사단은 왜 들어갔고 현장조사는 왜 늦어졌나 (0) | 2026.09.25 |
| 제주 리조트 폭행 논란 민사라 경찰이 못 막는다? (0) | 2026.09.25 |
| 유튜브 먹방 규제 시작됐나? 수익창출 중단 이유와 실제 규제 범위 (0) | 2026.09.21 |