EN

읽을거리 · AI 디자인

'디자인 보는 눈'을 내세운 Claude Sonnet 5.5, 중간 가격 모델이 달라졌다

앤트로픽이 9월 28일 내놓은 Sonnet 5.5는 발표문에서 디자인 감각을 앞세웠다. 가격은 그대로, 일은 더 빠르게. 실제로 한 페이지짜리 사이트를 시켜 본 결과까지 숫자로 정리했다.

· 읽는 데 약 3분

앤트로픽이 9월 28일(미국 시간) Claude Sonnet 5.5를 내놓았다. 한국에서는 오늘 아침부터 소식이 돌았다.

Sonnet은 앤트로픽 모델 가운데 가운데 칸이다. 가장 비싸고 똑똑한 모델도 아니고, 가장 싸고 빠른 모델도 아니다. 그래서 보통은 발표가 조용한 편인데, 이번에는 눈에 띄는 문장이 하나 있었다. 앤트로픽은 이 모델이 "디자인을 보는 눈이 날카롭다"고 적었다.

중간 가격 모델이 디자인을 내세우는 건 흔한 일이 아니다. 그리고 이 칸은 디자이너와 생각보다 가깝다. AI 기능을 파는 툴 회사 입장에서는, 원가를 생각하면 가장 비싼 모델보다 이 가격대를 기본값으로 두고 싶기 마련이니까.

먼저 밝혀 둘 것. 나는 이 사이트를 클로드 코드로 만들고 있다. 그래서 회사 발표와 외부에서 직접 돌려 본 결과만 옮겼고, 누가 잰 숫자인지 적었다.

값은 그대로, 칸은 붐빈다

가격은 Sonnet 5와 같다. 100만 토큰에 입력 2달러, 출력 10달러. 달라진 건 속도와 말의 양이다. 앤트로픽은 이전 모델보다 30% 넘게 빠르고, 같은 일을 더 적은 토큰으로 끝내서 대부분의 작업에서 비용이 최대 30% 줄어든다고 했다.

100만 토큰당 가격. 입력 2달러, 출력 10달러 칸에 두 회사의 모델이 나란히 서 있다.
100만 토큰당 가격. 입력 2달러, 출력 10달러 칸에 두 회사의 모델이 나란히 서 있다.

그래프로 놓고 보면 재미있는 게 보인다. 2달러·10달러 칸에 오픈AI의 GPT-6 Sol도 서 있다. 지난주 가격이 반으로 내려간 한 주를 지나고 나니, 두 회사의 중간 모델이 정확히 같은 값에서 마주 보게 된 셈이다. 맨 위 칸은 여전히 입력 10달러, 출력 50달러다.

무엇을 잘한다고 했나

앤트로픽이 꼽은 쓰임새는 이렇다. 범위가 분명한 일상 작업, 버그 고치기, 그리고 문서·슬라이드·스프레드시트를 깔끔하게 만드는 일. 여기에 디자인이 붙었다. 화면에 마감을 더하고, 템플릿을 잘 따른다는 설명이다. 내부 시험에서는 손볼 데가 거의 없는 투자 발표 자료를 만들었다고 했다.

평가Sonnet 5Sonnet 5.5누가 쟀나
GDPval-AA (실무 문서 작업)14491844앤트로픽 발표
FrontierCode (최대 노력)42.4%46.2%앤트로픽 발표
속도기준30% 넘게 빠름앤트로픽 발표

출처: 앤트로픽 Claude Sonnet 5.5 소개. GDPval-AA에서는 상위 모델 Opus 5.5보다 2점 낮다고 함께 밝혔다.

발표 표에는 좋은 숫자만 모이기 마련이다. 그래서 바깥에서 직접 시켜 본 결과가 더 궁금했다.

한 페이지짜리 사이트를 시켜 보니

공개 직후 개발자 Thomas Wiegold가 블로그에 올린 시험이 있다. 과제는 'Low Tide'라는 가상의 행사 사이트 한 페이지. 바닷가에서 단편 영화 세 편을 트는 야외 상영회다. 날짜, 입장 시간, 상영작, 표, 자주 묻는 질문까지 내용은 정해 주고, Opus 5.5, Sonnet 5.5, Sonnet 5에 같은 조건으로 맡겼다.

순위는 Opus 5.5, Sonnet 5.5, Sonnet 5 순이었다. 그런데 결과물의 성격이 흥미롭다.

Opus 5.5는 분위기로 갔다. 노을 위에 부드러운 'Low Tide' 글자를 얹고, 글자와 해가 수면에 비치게 했다. 애니메이션이 아홉 개였고 접근성 처리도 가장 꼼꼼했다.

Sonnet 5.5는 인쇄물 쪽으로 갔다. 크림색과 남색 바탕에 납작한 주황 해, 정자체와 이탤릭을 짝지은 타이포. 애니메이션은 네 개뿐이지만 골라서 넣었고, 움직임을 줄이고 싶은 사람을 위한 설정도 챙겼다. 리뷰어는 Opus와 같은 슬라이더 아이디어를 떠올리고도 전혀 다른 모습으로 풀어냈다는 점을 짚었다.

Sonnet 5는 필름 릴이라는 주제를 기계적으로 적용했다. 테두리에 필름 구멍을 뚫고 섹션마다 릴 번호를 붙이는 식이다. 아이디어는 있는데 템플릿 같았다는 평이다.

같은 과제에 든 비용과 시간, 말의 양. Sonnet 5.5는 Opus보다 싸고, 말은 더 많이 했다.
같은 과제에 든 비용과 시간, 말의 양. Sonnet 5.5는 Opus보다 싸고, 말은 더 많이 했다.

숫자도 볼 만하다. Sonnet 5.5는 1.35달러로 Opus 5.5(1.94달러)보다 30% 싸게 끝냈다. 다만 출력 토큰은 오히려 Opus보다 많았다. 토큰 값이 싸서 전체 값이 내려간 것이지, 말수가 줄어서가 아니었다. 과제 하나를 한 번씩 돌린 개인 시험이라 이것만으로 우열을 가를 수는 없다.

중간 칸이 좋아지면 달라지는 것

디자이너가 모델 이름을 골라서 쓰는 일은 생각보다 적다. 대개는 쓰는 툴이 정해 둔 모델을 그대로 쓰고, 그 툴이 어떤 칸의 모델을 쓰는지는 원가가 정한다.

그러니 중간 칸의 디자인 감각이 올라가면, 이름을 모르는 채로 쓰던 도구들의 첫 시안이 같이 나아질 수 있다. 가장 비싼 모델의 점수보다 이쪽이 매일의 작업에 더 가깝다.

직접 확인하는 방법은 어렵지 않다. 자주 쓰는 템플릿 하나와 브랜드 가이드 한 장을 주고 같은 페이지를 만들게 해 보자. 템플릿을 얼마나 지키는지, 여백과 글자 크기를 어디서 흐트러뜨리는지 보면 된다. 이번 발표에서 앤트로픽이 가장 자신 있어 한 대목이 바로 거기라서다.

모델 이름이 헷갈린다면 지난번 Fable 5.1과 아스트라 비교를 같이 보면 칸이 정리된다. 쓰임새별 도구는 AI 디자인 툴에 모아 두었다.

함께 읽으면 좋은 글

읽을거리 전체 보기 (10편) →