2026.07.29 접속자 173
로그인 회원가입
HOT
[AI뉴스] 올해는 진짜 AI 에이전트가 대세네요 [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [AI뉴스] 요즘 딥러닝 논문들 뭐가 화제네요.. 성능 높이는 것보다 효율성 쪽에 더 집중하는 중 [프롬프트] 코드 리뷰할 때 쓰는 프롬프트 공유합니다 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [프롬프트] 요약 프롬프트 좋은 예시 있으신가요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [자유게시판] 요즘 혼자 밥 먹는데 괜찮더라고요 [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [AI뉴스] 올해는 진짜 AI 에이전트가 대세네요 [프롬프트] ChatGPT한테 "너는 개발자야"라고 설정하니까 코드 퀄리티가 확 달라지네요 [AI뉴스] 요즘 딥러닝 논문들 뭐가 화제네요.. 성능 높이는 것보다 효율성 쪽에 더 집중하는 중 [프롬프트] 코드 리뷰할 때 쓰는 프롬프트 공유합니다 [프롬프트] 업무 자동화 프롬프트 짜다가 깨달은 거 있어서 공유합니다 [AI뉴스] 2026년 AI 산업 지금 어떤 단계까지 갔나요? [프롬프트] 요약 프롬프트 좋은 예시 있으신가요? [프롬프트] 논문 요약할 때 쓰는 프롬프트 공유합니다 [자유게시판] 요즘 혼자 밥 먹는데 괜찮더라고요 [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요?
활용법

최근 LLM들 문맥 이해 능력 비교해보니까 생각보다 차이가 크네요

조용한엔지니어 2026.06.29 12:08 조회 79 추천 8 댓글 1건
회사 프로젝트에서 복잡한 요구사항을 여러 모델에 줘봤는데 결과가 꽤 달랐어요. 특히 길이가 긴 문서에서 핵심을 파악하고 일관성 있게 코드를 생성하는 부분에서 모델마다 편차가 심하더라고요. 가격이 비싼 모델이 항상 낫진 않다는 게 흥미로웠습니다.

최근엔 claude 3.5 sonnet이랑 gpt-4o를 주로 쓰는데, claude가 맥락을 더 잘 잡는 느낌이 들어요. 특히 이전 대화 내용을 반영해서 수정 요청할 때 실수가 적더라고요. 근데 gpt는 가끔 이전 지시를 무시하고 엉뚱한 방향으로 가는 경우가 있어서 조금 답답할 때가 있습니다.

혹시 비슷한 경험하신 분들 있으신가요? 아니면 내가 프롬프트를 잘못 쓰는 걸까요?
추천 8 비추천 0
댓글 1

댓글목록

profile_image
AI새싹
저도 비슷한 경험했는데 claude가 확실히 컨텍스트를 더 잘 유지하더라고요. gpt-4o는 긴 문서에서 중간중간 놓치는 부분이 있는 것 같아요. 프롬프트 문제라기보다는 모델 아키텍처 차이인 것 같습니다. 요즘엔 상황에 따라 섞어 쓰고 있는데 claude는 코드 수정, gpt는 빠른 프로토타이핑 용으로 나눠서 쓰시는 것도 방법일 수 있습니다.