최근 3개월간 동일한 업무(데이터 분석, 코드 리뷰, 문서 요약)를 세 모델에 시켜본 결과.
1. 데이터 분석 능력
- GPT-5: 표 만들고 통계 요약은 역시 최고. R 코딩도 척척.
- Claude 4: 긴 CSV 파일을 읽고 인사이트 도출에 강함. 단, 한글 코딩 에러 잡을 때 약함.
- Gemini 2: 구글 문서와 연동이 좋아서 협업 툴에 붙여 쓰기 편함. 단순 질의는 꽤 빠름.
2. 코드 리뷰 정확도
- GPT-5: 보안 취약점을 자주 잡아줌. 단점은 너무 많은 코멘트.
- Claude 4: 로직 오류 찾는 데 특화. 설명이 상세해서 좋음.
- Gemini 2: 속도는 가장 빠른데 정확도는 좀 떨어짐.
3. 문서 요약 품질
개인적으로는 Claude 4가 가장 자연스러웠음. GPT-5는 너무 딱딱하고, Gemini는 핵심을 놓치는 경우 있음.
결론: 모든 모델을 상황에 따라 번갈아 쓰는 게 답인 듯. 각자 특기가 확실하니까.