본문으로 건너뛰기
소개 · 카테고리
H

김회승

한의사로 일하며, 배우고 만드는 과정을 기록합니다. 직접 써본 제품과 찾아간 맛집, 일상과 한의학 공부 이야기를 나눕니다.

전체 목록 열기

    GPT-6.1 Sol 하루 사용기: 느려도 바이브코딩에 추천하는 이유

    목차

    먼저 읽는 요약

    • 사용 조건 — Pro x20에서 하루 정도 사용한 후기입니다. 이용 경로와 API 가격은 2026년 10월 1일 안내 기준입니다.
    • 좋았던 점 — 아스트라에 가까운 성능과 획기적으로 적게 느껴진 토큰 사용량, 꽤 괜찮았던 컴퓨터 유즈입니다. 동일 작업의 정량 비교는 아닙니다.
    • 아쉬웠던 점 — 매우 느립니다. 바로 결과를 받아 다음 수정을 지시해야 할 때는 기다림이 큰 단점입니다.
    • 다시 고른다면 — 시간이 크게 상관없는 바이브코딩 작업에는 강하게 추천하며 저도 계속 쓸 생각입니다.
    OpenAI가 공개한 GPT-6.1 Sol.
    OpenAI가 공개한 GPT-6.1 Sol.

    OpenAI가 2026년 9월 29일 DevDay에서 발표한 GPT-6.1 Sol을 하루 정도 써봤습니다. 절대경로의 첫 글로 고른 모델이기도 합니다. 처음 바이브코딩을 시작하거나 이미 AI에게 코딩을 맡기고 있는 사람이라면 눈여겨볼 만했습니다.

    아스트라에 근접했다는 말이 납득됐고, 토큰 사용량도 획기적으로 적게 느껴졌습니다. 다만 추천하면서도 시간을 먼저 물어보고 싶어지는 종류의 느림이 있었습니다. 장점이 많으니 단점 하나쯤 적는 의례적인 이야기는 아닙니다. 그 느림을 감수할 수 있는 작업이라면 강하게 추천하고 싶습니다.

    낮았던 기대를 바꾼 하루의 사용 경험

    기존 GPT-6 Sol은 정말 별로였고 오히려 5.6 Sol이 나았다는 평가까지 접해 기대가 낮았습니다. 이름 뒤에 0.1이 붙었다고 갑자기 반가워할 이유가 생긴 것은 아니었습니다. 그런데 하루 정도 써보니 전작보다 조금 나아진 정도를 넘어 아스트라와 꽤 가까워졌다는 체감이 있었습니다.

    원래 아스트라 마이너로 나올 모델이었다는 추측도 접했지만, 확인된 내부 계보는 아닙니다. 족보까지 알아야 마음에 들어 할 수 있는 물건은 아니니 저는 실제로 써봤을 때 괜찮았다는 쪽에 더 무게를 둡니다.

    DeepSWE 1.1의 코딩 점수와 작업당 비용 비교.
    DeepSWE 1.1의 코딩 점수와 작업당 비용 비교.

    OpenAI의 DeepSWE 1.1 코딩 평가에서도 6.1 Sol은 아스트라와 비슷한 성능을 약 1/5의 과제 비용으로 냈습니다. 그래프의 노란 6.1 Sol이 파란 아스트라와 비슷한 점수대이면서 훨씬 왼쪽에 있습니다. 가로축은 작업당 비용이므로 그 점수에 도달하는 비용이 낮다는 이야기입니다.

    모든 코딩 작업에서 두 모델이 같다는 보장은 아니지만, 하루 동안 제가 느낀 매력도 그 방향이었습니다. 아스트라에 가까운 결과를 기대하면서 토큰 부담은 덜 수 있겠다는 점입니다. 단순히 싸기만 한 모델이었다면 이렇게 반갑지는 않았을 것입니다.

    Pro x20에서도 반가웠던 사용량 감소

    저는 Pro x20을 쓰고 있었는데도 아스트라의 토큰 비용이 정말 부담스러웠습니다. 많이 쓸 수 있는 요금제라도 좋은 모델을 넉넉히 쓰고 싶은 욕심까지 커지면 사정이 간단하지 않습니다. 성능에 만족하는 것과 계속 쓰는 부담은 별도로 남았습니다.

    바이브코딩은 원하는 기능과 수정 사항을 자연어로 설명하고, AI가 만든 코드와 실행 결과를 확인하며 고쳐가는 개발 방식입니다. 이름에 바이브가 들어갔다고 검토와 테스트까지 분위기로 해결되지는 않습니다. 설명과 확인을 반복하는 만큼 한 번 훌륭한 답을 받는 것 못지않게 그다음 수정도 부담 없이 맡길 수 있느냐가 중요합니다.

    그 점에서 6.1 Sol의 토큰 감소 폭은 꽤 크게 느껴졌습니다. 같은 작업을 나란히 돌려 몇 퍼센트를 줄였다고 계산한 결과는 아니지만, 하루 사용에서 획기적으로 덜 든다는 인상은 분명했습니다. Pro x20을 쓰는 저도 반가운 차이라 처음부터 높은 요금제가 부담스러운 사람에게도 눈여겨볼 만했습니다.

    Codex에서 GPT-6.1 Sol을 선택한 화면.
    Codex에서 GPT-6.1 Sol을 선택한 화면.

    그렇다고 처음 바이브코딩 AI를 고르는 사람에게 저처럼 높은 요금제부터 쓰라고 권하고 싶지는 않습니다. Codex는 코딩을 맡기는 도구이고 GPT-6.1 Sol은 그 안에서 고르는 모델입니다. 앱 전체를 갈아타기보다 이미 쓰는 도구에서 선택할 수 있는지, 지금 요금제 안에서 얼마나 쓸 수 있는지부터 보는 편이 낫습니다.

    2026년 10월 1일 기준 출시 안내에서는 Plus·Pro·Business·Enterprise·Edu의 ChatGPT Work와 Codex에 제공되며, 일반 ChatGPT Chat에는 아직 제공되지 않는다고 합니다. API에서는 gpt-6.1-sol로 사용할 수 있습니다. 같은 ChatGPT라는 이름이어도 평소 채팅창과는 구분됩니다. 비용 효율 개선이 무료나 무제한 이용을 뜻하지 않으므로 계정의 모델 목록과 사용 한도를 함께 봐야 합니다.

    API 가격과 구독 사용량의 차이

    구분GPT-6 AstraGPT-6.1 SolAstra 대비 Sol 단가
    입력$10$21/5
    캐시 입력$1$0.101/10
    출력$50$101/5

    ‘아스트라 가격의 1/10’이라는 이야기는 나눠 볼 필요가 있습니다. 위 표는 2026년 10월 1일 기준 표준 API 기본 단가이며 단위는 100만 토큰당 미국 달러입니다. 입력과 출력은 1/5이고, 캐시 입력만 1/10입니다. 재사용하는 입력에 캐시 가격이 적용될 때와 매번 새로 넣는 입력을 묶어 전부 열 배 싸다고 할 수는 없습니다. 캐시 쓰기·긴 입력·처리 옵션 등의 별도 요금은 제외한 비교입니다.

    토큰 단가가 낮은 것, 실제 사용한 토큰 수가 적은 것, 구독에서 허용하는 사용량은 각각 다릅니다. 이 표를 제 Pro x20의 한도에 그대로 곱할 수는 없습니다. 정확히 다섯 배 더 쓴다는 보장은 없어도, 제 사용에서는 성능을 크게 양보한다는 느낌 없이 사용량 부담이 줄었습니다. 계속 선택할 이유는 그쪽에 있습니다.

    컴퓨터 유즈도 실제로 꽤 괜찮았습니다

    OSWorld 2.0 오프라인 세트의 컴퓨터 사용 평가.
    OSWorld 2.0 오프라인 세트의 컴퓨터 사용 평가.

    화면과 애플리케이션을 다루는 컴퓨터 유즈 역시 실제로 사용해보니 꽤 괜찮았습니다. 코드 작성만 좋아진 모델보다 제게 더 반가웠던 부분입니다.

    공식 OSWorld 2.0 오프라인 평가에서는 최대 추론 강도끼리 비교했을 때 6.1 Sol이 기존 6 Sol보다 7%포인트 높은 점수를 내면서 과제 비용은 절반 미만이었습니다. 아스트라와의 점수 차이는 2.1%포인트, 과제 비용은 약 1/7입니다. 2026.08.08 버전 오프라인 세트에서 부분 점수를 포함해 계산했으므로 모든 작업을 처음부터 끝까지 완수한 비율로 읽으면 안 됩니다.

    여기서도 제 눈길을 끄는 것은 비슷한 높이에 도달하는 데 드는 비용입니다. 실제 컴퓨터 유즈도 괜찮았기에 저렴한 모델로 옮기면서 이 기능을 포기해야 하나 하는 걱정이 줄었습니다. 코딩과 컴퓨터 사용 양쪽에서 계속 써볼 만하다고 느꼈습니다.

    그런데 정말, 너무 느립니다

    아스트라에 가까워졌다는 체감에 속도까지 포함되지는 않습니다. 느립니다. 너무 느립니다. 성능과 사용량이 마음에 들어도 기다리는 답답함까지 좋게 해석할 생각은 없습니다.

    ‘똑똑한 루나맥스’나 ‘속도도 아스트라의 1/10’이라는 평가를 접했을 때 어떤 심정인지 알겠더군요. 정식 모델 분류도, 제가 시간을 재서 얻은 속도 배율도 아닙니다. 다만 그런 과장에 기대고 싶어질 만큼 제 사용에서는 느림이 큰 단점이었습니다.

    응답을 보며 바로 다음 수정을 지시해야 할 때 매번 기다리면 토큰을 아낀 대신 제 시간이 나갑니다. 계산서에 안 찍힌다고 기다리는 시간이 공짜가 되는 것은 아닙니다. 당장 결과가 필요한 작업이라면 낮은 단가만 보고 선택할 모델은 아니라는 게 제 판단입니다.

    반대로 맡긴 결과를 조금 늦게 확인해도 된다면 결과의 수준과 사용량 부담이 더 중요해지는 일이 있습니다. 그런 작업에서는 기다릴 이유가 충분합니다. 별도로 안내된 Sol Ultrafast는 실제 제공 여부와 요금을 따로 볼 대상입니다. 여기서 말한 저렴한 표준 Sol에 빠른 속도까지 덤으로 붙는 것은 아닙니다.

    총평: 시간이 여유로운 바이브코딩 작업에는 강하게 추천합니다

    처음 바이브코딩을 시작하는 사람, 아스트라를 계속 쓰는 비용이 부담스러운 사람, 상대적으로 저렴한 요금제 안에서 쓸 만한 모델을 찾는 사람에게 6.1 Sol을 강하게 추천하고 싶습니다. 단서는 시간이 크게 상관없는 작업이어야 한다는 것입니다. 저도 그런 일에는 계속 쓸 생각입니다. 느림이 좋아서가 아니라, 감수하고도 아스트라에 가까운 체감과 적은 토큰 사용량을 놓치기 아깝기 때문입니다.

    GPT-6.1 Sol, 느려도 바이브코딩에 추천하는 이유 대표 이미지
    ← 목록으로 돌아가기

    공유하기

    이메일

    전체 글 보기