제미나이 temperature 폐지 — 공식 문서 네 쪽이 갈렸고, 모델 50개 중 43개는 아직 그 값을 싣고 있어요
제미나이 릴리스 노트가 샘플링 파라미터 세 개를 폐지로 선언했는데, API 레퍼런스는 아직 Optional이고 텍스트 생성 가이드는 예제에 그대로 넣어요. 지금 보내면 어떻게 되는지 모델 다섯 개에 직접 쳐 봤어요. 2026년 8월 22일 오후 관측이에요.
AI 기술을 누구나 쉽게 활용할 수 있도록 실전 가이드를 작성합니다. ChatGPT, Claude, AI 자동화, SEO 분야를 전문으로 다룹니다.
Cursor가 Composer 2.5를 출시하면서 Windsurf SWE-1.5(Cerebras 950 tok/s)와 자체 코딩 모델 정면 충돌. 두 제품 모두 Pro $20 가격 동등, 자체 모델로 Opus 4.7·GPT-5.5와 경쟁하는 시기. 7가지 작업으로 직접 비교한 결과 정리.
핵심 차이 3가지. (1) 베이스 모델 — Composer 2.5는 오픈소스 베이스 + Cursor 자체 후처리, SWE-1.5는 Windsurf 자체 학습. (2) 속도 vs 정확도 — SWE-1.5는 950 tok/s 속도가 강점이고 SWE-Bench Pro는 40.08%, Composer 2.5는 속도를 양보하는 대신 정확도가 앞서요. (3) 가격 모델 — Composer 2.5는 토큰 단위 과금, SWE-1.5는 Pro $20 무과금 + quota 한도.
이번 글은 7가지 실전 작업에서 어느 쪽이 본전이고 한국 1인 개발자가 어떻게 선택해야 하는지 정리.

첫 번째 작업. import 채우기·다음 줄 제안·간단 if-else 분기 같은 일상 자동완성. 체감 순서는 SWE-1.5가 가장 빠르고 Composer 2.5, Opus 4.7 순서. SWE-1.5의 950 tok/s가 압도적으로 느껴지는 구간이에요.
정확도는 이 정도 단순 작업에서 셋 다 큰 차이가 없었어요. 결국 속도가 결정 요인이라 SWE-1.5 우위. 단 Composer 2.5는 비용이 토큰 단위라 자동완성을 많이 써도 부담이 크게 튀지는 않아요.
권장 — 일상 자동완성만 보면 SWE-1.5 본전. 단 IDE 차이(Cursor VS Code 단독 vs Windsurf 40+ IDE) 고려 필요. VS Code 사용자는 Composer 2.5도 충분.
두 번째 작업. 사용자 인증 미들웨어·결제 모듈 같은 50줄+ 새 코드. 정확도 차이가 명확히 드러나는 영역.
같은 프롬프트로 사용자 인증 모듈을 생성해봤어요. (1) SWE-1.5 — 첫 시도 결과를 여러 번 손봐야 했어요. 패턴 일관성 약함. (2) Composer 2.5 — 첫 시도부터 쓸 만한 수준이고 수정 횟수가 적었어요. 패턴 일관성·에러 처리 우수. (3) Opus 4.7 — 가장 안정적. Composer 2.5가 SWE-1.5 대비 명확히 우위, Opus 4.7과는 큰 차이를 못 느꼈어요.
비용 관점에서는 신규 모듈 생성 1회에 드는 토큰이 크지 않아서 Composer 2.5 과금이 부담되지 않아요. SWE-1.5는 무과금이지만 수정을 반복하는 시간 비용이 커요. 추천 — 신규 모듈은 Composer 2.5 단독이 본전.
세 번째 작업. 여러 파일에 걸친 버그 추적. 두 자체 모델 모두 약하고 외부 모델 호출 본전.
같은 버그(데이터베이스 트랜잭션 deadlock)로 디버깅을 시도해봤어요. (1) SWE-1.5 — 단일 파일 범위를 벗어나면 원인을 잘 못 짚었어요. (2) Composer 2.5 — 멀티 파일 추적은 SWE-1.5보다 나았지만 한 번에 해결하지는 못했어요. (3) Opus 4.7 — 원인을 가장 자주 맞혔어요. 복합 디버깅은 Opus 4.7 압도적.
권장 분업 — 1차 분석은 Composer 2.5·SWE-1.5로 가설 생성 → 검증·해결은 Opus 4.7. 이 흐름으로 바꾸고 나서 디버깅에 매달리는 시간이 눈에 띄게 줄었어요.

네 번째 작업. 한국어 함수 설명·README·코멘트 작성. 두 자체 모델은 외부 프런티어 모델과 한국어 품질 차이가 확연했어요.
두 자체 모델 모두 한국어 약함. (1) SWE-1.5 — 직역체 잦음, 한국 비즈니스 도메인 컨텍스트 부정확. (2) Composer 2.5 — 영어·중국어 쪽이 강하고 한국어는 어색한 문장이 섞여요. (3) 외부 모델 — GPT-5.5·Opus 4.7이 한국어 자연스러움 압도적.
권장 — 코드 생성은 자체 모델, 한국어 docstring·README는 외부 모델 분리. 본인은 Cursor에서 Opus 4.7 API 키 등록 + Composer 2.5로 코드 → Opus 4.7로 한국어 문서 흐름.
다섯 번째 작업. Dockerfile·Terraform·Kubernetes manifest 작성. 이 영역은 Composer 2.5가 눈에 띄게 앞섰어요.
차이가 난 지점 — SWE-1.5는 일반 코드 패턴에 강한 대신 인프라 특화 문법에서 자잘한 실수가 잦았어요. Terraform HCL 문법·k8s YAML 들여쓰기 같은 디테일에서 차이가 명확했어요.
권장 — 인프라 작업이 많은 1인 개발자(DevOps·SRE)는 Composer 2.5 본전. SWE-1.5로 만든 인프라 코드는 반드시 본인이 문법 검증 후 적용하세요.
여섯 번째 작업. SQL 쿼리·데이터 분석·BigQuery·Postgres 작성. 두 모델 사이에 의미 있는 차이를 못 느꼈어요.
특수 케이스 — (1) 윈도 함수·CTE — 둘 다 흔들리는 구간이고 Opus 4.7이 확실히 우위. (2) 간단 SELECT·JOIN — 둘 다 안정적이라 외부 모델 호출 불필요. (3) PL/SQL·트리거 — 외부 모델 권장 영역.
권장 — 일반 SQL 작업은 본인 익숙한 IDE의 자체 모델 사용. 복잡 쿼리는 Opus 4.7 분업.
일곱 번째 작업. Jest·Pytest·Go testing 같은 테스트 코드 자동 생성. 여기서도 Composer 2.5가 앞섰어요.
차이 — (1) 테스트 케이스 완전성 — Composer 2.5가 엣지 케이스·예외 처리 케이스 더 많이 생성. (2) 모킹 패턴 — Composer 2.5가 jest.mock·pytest fixture 같은 표준 패턴 정확. (3) Korean 코멘트 — 둘 다 약함, 외부 모델 분리.
권장 — 테스트 코드는 Composer 2.5 본전. 본인은 새 함수 작성 → Composer 2.5로 테스트 자동 생성 → 1~2개 케이스 본인 추가 흐름.
내부 링크: Cursor Composer 2.5 첫 5일 테스트는 Cursor Composer 2.5 첫 5일 실측 Opus 4.7·GPT-5.5 비교에서, Windsurf SWE-1.5 첫 2주 후기는 Windsurf Arena Mode SWE-1.5 첫 2주 7가지 테스트에서, Cursor vs Windsurf 가격 비교는 Cursor vs Windsurf 2026 5월 $20 비교에서 확인하면 좋아요.
7가지 작업을 한 줄로 요약. 일상 자동완성·간단 SQL은 SWE-1.5 속도 본전, 신규 모듈·인프라·테스트 코드는 Composer 2.5 정확도 본전, 복합 디버깅·한국어 문서는 Opus 4.7 외부 호출 분업. 월 비용은 Pro 구독료에 자체 모델 토큰과 외부 모델 호출이 얹히는 구조라 작업량에 따라 편차가 커요. 첫 달 사용량을 직접 확인한 뒤 판단하세요.
지금 당장 할 일 — (1) 본인 일상 코딩 작업 7가지 카테고리 분류, (2) 1주일씩 Cursor·Windsurf 시도, (3) 본인 페르소나에 맞는 쪽 선택, (4) Opus 4.7·GPT-5.5 외부 API 키 등록 + 분업 운영.
직접 겪은 실수. (1) 자체 모델 단독 의존 — 한국어 문서·복합 디버깅은 외부 모델 분업 필수. (2) 빠른 티어 풀데이 — Composer 2.5 빠른 티어는 표준보다 확실히 비싸니 라이브 데모에만 쓰세요. (3) 벤치마크만 보고 결정 — 본인 사용 패턴 1주일 측정이 더 중요. (4) IDE 차이 무시 — JetBrains·Vim 사용자는 Windsurf 필수. (5) 장애 대비 미준비 — Cerebras 장애·Cursor 장애 시 대안 1개 항상 유지.
한국 1인 개발자 추가 팁. (1) 달러 결제 카드 확인 — Cursor·Windsurf 둘 다 달러 결제라 해외 결제 수수료가 낮은 카드가 유리해요. (2) 세금계산서 요청 — 둘 다 영업팀에 사업자 등록 + 자동 발행. (3) 부가세 환급 — 사업자 부가세 분기 환급. (4) 백업 도구 유지 — Claude Code·VS Code 기본 자동완성 1개 항상 준비. (5) 월 1회 비용 점검 — 청구액과 절감 시간을 같이 보고, 본전이 안 나오면 도구를 바꾸세요.
도구 선택은 남의 벤치마크가 아니라 본인 사용 로그로 결정해야 정확해요. 1주일만 아래 항목을 기록해보세요. (1) 자동완성 사용 빈도 — 자동완성 비중이 크면 속도 우위인 SWE-1.5 쪽이 유리해요. (2) 에이전트 호출 빈도 — 멀티 파일 작업을 자주 던진다면 정확도 우위인 Composer 2.5 비중을 키우세요. (3) 외부 모델 호출 빈도 — 복합 디버깅과 한국어 문서에서 얼마나 자주 외부 모델로 넘어가는지 세어보면, 자체 모델만으로 될 일인지 판단이 서요. (4) 수정 횟수 — 첫 결과를 몇 번 손봤는지가 실제 체감 정확도예요. 정확도 숫자보다 이 지표가 정직해요. (5) 월 청구액 — Pro 구독료 + 자체 모델 토큰 + 외부 호출을 합쳐 실제 청구서로 확인하세요.
이 다섯 개만 있으면 "어느 쪽이 본전인가"를 감이 아니라 본인 데이터로 답할 수 있어요. 특히 수정 횟수와 청구액은 같이 봐야 해요. 무과금 모델이라도 결과를 세 번 고치면 시간 비용이 더 크고, 토큰 과금 모델이라도 한 번에 끝나면 결국 싸게 먹혀요.
마지막. 두 도구를 함께 굴려본 뒤 정리한 한국 1인 개발자 추천 선택 가이드. (1) 풀데이 코딩 + VS Code 익숙 → Cursor + Composer 2.5. 정확도·신규 설계 우위, 본인 본전 선택. (2) 사이드 프로젝트·주말 코딩 → Windsurf + SWE-1.5. Pro $20 무과금 quota 충분, 속도 압도적. (3) JetBrains·Vim·NeoVim 사용자 → Windsurf 무조건. IDE 지원 차이가 결정적. (4) 인프라·DevOps 중심 → Cursor + Composer 2.5. 인프라 코드 문법 정확도가 앞섰어요. (5) 한국어 문서 비중 큼 → 둘 다 + Opus 4.7·GPT-5.5 외부 분업. 자체 모델 단독 한계 명확. 본인 결론 — 풀데이 코딩하는 1인 개발자는 Cursor가 약간 본전, 부업·실험은 Windsurf 본전이에요. 둘 다 1개월씩 사용 후 본인에게 맞는 쪽 선택이 가장 안전합니다.
자체 모델과 외부 프런티어 모델을 어떻게 나눠 쓸지 기준을 정리했어요. 자체 모델(커서 컴포저·윈드서프 에스더블유이 모델)은 자동완성·단순 리팩터링·테스트 생성 같은 일상 작업 본전, 외부 모델(클로드 오푸스·지피티)은 복합 디버깅과 한국어 문서 작성처럼 판단이 필요한 작업 본전이에요. 실무에서는 호출 횟수 기준으로 자체 모델 비중이 훨씬 크고, 외부 모델은 막혔을 때만 꺼내 쓰는 형태로 굳어져요. 비용도 같은 비율로 따라가서 구독료가 대부분을 차지하고 외부 호출이 변동분이 돼요. 중요한 건 절대 금액이 아니라 이 변동분을 본인이 통제하고 있느냐예요. 외부 호출을 습관적으로 먼저 쓰면 청구액이 빠르게 불어나니, 자체 모델로 먼저 시도하고 두 번 실패하면 외부 모델로 넘기는 규칙 하나만 세워도 비용이 안정됩니다.
마지막 정리. 2026년 5월 두 자체 코딩 모델 동시 출시 배경 분석. 한국 1인 개발자가 시장 흐름을 이해해야 본인 도구 선택 결정에 도움. 첫째 흐름은 코딩 IDE의 자체 모델 시대 진입. 작년까지는 커서·윈드서프 같은 IDE가 외부 프런티어 모델(클로드·지피티) 호출 의존이었어요. 사용자 호출이 외부 모델 회사 매출로 직결 + IDE 회사 마진 깎임. 자체 모델 출시로 (1) 외부 의존 줄이고, (2) 비용 통제 + 사용자 본전, (3) 차별화 무기 확보. 둘째 흐름은 오픈소스 베이스 모델 활용. 딥시크·라마 같은 오픈소스 모델이 작년부터 강해지면서 IDE 회사가 베이스 + 후처리 패턴 확립. 커서는 오픈소스 베이스에 자체 후처리, 윈드서프는 자체 학습 쪽이에요. 셋째 흐름은 하드웨어 최적화. 윈드서프는 세레브라스 하드웨어로 950 초당 토큰 출력, 커서는 표준 GPU + 후처리 정확도 강점. 하드웨어 선택이 가격·속도·정확도 균형 결정.
한국 1인 개발자가 이 흐름에서 본전 잡는 전략. (1) 일단 두 자체 모델 모두 1주일씩 사용해보고 본인 페르소나 확인. (2) 자체 모델 + 외부 모델 분업 흐름 정착(일상 80퍼센트 자체 + 복잡 20퍼센트 외부). (3) 6개월마다 신모델 출시 확인 + 본인 도구 스택 재평가. (4) 베이스 모델 오픈소스화 흐름 모니터링(강한 오픈소스 모델이 나올수록 IDE 자체 모델도 함께 강해질 가능성). (5) 한국어 작업 비중 큰 사용자는 외부 모델 호출 비중 더 크게 유지가 안전. 본인 1인 개발자 입장에서 이 흐름 타고 풀스택 자동화 페이스로 가는 게 본전이에요.
두 자체 모델을 함께 굴려보며 정리한 6개월 전망. 한국 1인 개발자가 도구 선택 결정에 참고할 흐름이에요. 첫째, 커서 컴포저 후속 버전 출시 가능성. 베이스 모델이 한 세대 올라가면 정확도가 함께 오르고, 가격이나 빠른 티어 단가가 조정될 여지도 있어요. 둘째, 윈드서프 에스더블유이 이쩜영 출시 가능성. 세레브라스 새 하드웨어 활용 + 더 큰 모델 크기 + 정확도 향상 예상. 다만 속도 우위는 유지될 듯. 셋째, 외부 프런티어 모델 가격 인하. 클로드 오푸스 사쩜팔·지피티 오쩜육 같은 신모델 출시 시 자체 모델 대비 가격 차이 좁아질 수 있음. 자체 모델 경쟁력 약화 위험. 한국 1인 개발자 추천 — 6개월마다 시장 흐름 재평가 + 본인 도구 스택 1년 단위 갱신이 본전 페이스입니다. 결정 늦추지 말기.
Cursor Composer 2.5는 Cursor가 내놓은 자체 코딩 모델이에요. 오픈소스 모델을 베이스로 자체 후처리 파이프라인(강화학습·연속 사전학습·텍스트 피드백)을 얹은 구조인데, 정확한 베이스 구성과 학습 비중은 Cursor 공식 발표에서 확인하는 게 안전해요. Windsurf SWE-1.5는 Cerebras 하드웨어에서 950 tok/s 출력하는 자체 모델. 차이 — (1) 베이스 모델 Composer 2.5는 오픈소스 베이스 + 자체 후처리·SWE-1.5는 자체 학습. (2) 속도 SWE-1.5가 950 tok/s로 명확히 빠름. (3) 벤치마크 SWE-1.5는 SWE-Bench Pro 40.08% 공개, Composer 2.5 점수는 공식 페이지 확인. (4) 가격 Composer 2.5는 토큰 단위 과금·SWE-1.5 Pro $20 무과금. (5) IDE 지원 Cursor 단독·Windsurf 40+ IDE.
단순 비교로는 SWE-1.5 무과금이 절대적으로 싸지만, 실질 비교는 (1) Composer 2.5 표준 티어 — 토큰 단위 과금이라 쓴 만큼 나가요. 정확한 단가는 Cursor 공식 요금 페이지에서 확인하세요. (2) SWE-1.5 — Windsurf Pro $20 무과금이지만 quota 한도가 있어요. 초과 시 추가 청구. (3) Composer 2.5 빠른 티어 — 표준보다 비싼 대신 응답이 빨라요. 라이브 데모용. 일상 사용자는 SWE-1.5, 작업량이 아주 많은 헤비 유저는 토큰 과금 쪽이 유리할 수 있어요. 작업량에 따라 갈림.
IDE 자체 모델인데도 프런티어 모델과 비슷한 구간까지 올라왔다는 게 핵심이에요. 다만 (1) 벤치마크 종류에 따라 순위가 갈림 — 터미널 작업 계열에서는 외부 프런티어 모델이 앞서는 항목이 있어요. (2) 자체 벤치마크는 참고만 — 제조사가 만든 벤치는 편향 위험이 있어요. (3) SWE-1.5 SWE-Bench Pro — 40.08%로 정확도 지표에서는 명확히 낮음. 결론 — Composer 2.5가 정확도, SWE-1.5는 속도. 정확도 우선이면 Composer 2.5, 속도 우선이면 SWE-1.5.
체감 차이 압도적. 100줄 함수처럼 출력량이 많은 작업에서 SWE-1.5가 눈에 띄게 먼저 끝나고, Composer 2.5, Opus 4.7 순서로 걸려요. 일상 자동완성·간단 리팩터링에서 SWE-1.5는 끊김이 거의 없어요. 다만 (1) 복잡 추론·다단계 설계는 속도 trade-off로 정확도 약함. (2) Cerebras 하드웨어 의존이라 장애 시 대안 없음. (3) Composer 2.5는 더 느리지만 안정성·정확도 균형이 좋아요. 본인 권장 — 일상 작업·라이브 데모 SWE-1.5, 복잡 설계·신뢰성 우선 Composer 2.5 분업.
(1) Composer 2.5 — 자체 모델이라 프런티어 모델을 직접 호출할 때보다 단가가 낮아요. (2) SWE-1.5 — Pro $20 무과금이지만 외부 모델(Opus 4.7·GPT-5.5) 호출은 quota 별도 사용. Cascade 멀티 스텝 에이전트에 quota 빠르게 소진. (3) 비용 최적화 패턴 — 일상 작업 대부분은 자체 모델, 복잡한 작업만 외부 모델 호출이 본전. Cursor·Windsurf 둘 다 같은 패턴. 차이는 자체 모델의 단가와 정확도 균형. 실제 월 비용은 작업량 편차가 커서 첫 달 사용량을 직접 확인하는 게 정확해요.
본인 추천 — IDE 자유도 우선이면 Windsurf. Cursor는 VS Code 포크 단독 작동, Windsurf는 VS Code·JetBrains·Vim·NeoVim·Xcode 등 40+ IDE 지원. JetBrains(IntelliJ·PyCharm·WebStorm) 사용자는 Windsurf 본전. Vim·NeoVim 사용자도 Windsurf. Cursor는 VS Code 익숙한 사용자에 본전. 다만 Cursor의 강점은 (1) VS Code 깊은 통합 + 자체 Composer 에이전트 매끄러움, (2) 단축키 흐름 빠름, (3) Cursor 3 Design Mode(시각 UI 반복). 본인은 VS Code 익숙 + Composer 에이전트 깊은 활용으로 Cursor 본전이었어요.
본인 추천 분기. (1) 풀데이 코딩 + 정확도 우선 → Cursor + Composer 2.5. 신규 모듈 설계·복합 디버깅·한국어 문서화 정확도 우위. (2) 사이드 프로젝트·속도 우선 → Windsurf + SWE-1.5. 950 tok/s 응답 + Pro $20 무과금. (3) JetBrains·Vim 사용자 → 무조건 Windsurf. IDE 지원 차이가 결정적. (4) 둘 다 시도 → 1개월씩 사용 후 본인 페르소나에 맞는 쪽 선택. 본인 결론 — 풀데이 코딩하는 1인 개발자는 Cursor + Composer 2.5 본전, 부업·사이드 프로젝트는 Windsurf SWE-1.5 본전이에요.