2026.08.01 접속자 30
로그인 회원가입
HOT
[AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [AI뉴스] 요즘 딥러닝 논문들 방향이 좀 달라졌더라고요 [프롬프트] AI한테 물어보는 방식 바꿔보니까 답의 질이 확 달라지더라고요 [프롬프트] 코드 리뷰 요청할 때 쓸 만한 프롬프트 있으신가요? [AI뉴스] 요즘 AI 계열 대기업들 움직임이 정신없네요 [AI뉴스] 올해 LLM 모델들 계속 쏟아지고 있네요 [AI뉴스] 요즘 LLM 모델들이 쏟아져 나오는데 뭘 써야 할지 모르겠어요 [프롬프트] 업무 지시사항을 프롬프트로 변환하니까 결과가 달라지네요 [프롬프트] 디자인 피드백 받을 때 쓸만한 프롬프트 있을까요? [기술 Q&A] LLM fine-tuning할 때 LoRA vs full fine-tuning 뭐가 더 낫나요 [AI뉴스] 요즘 AI 도입한 회사들 다들 어떻게 되어가고 있어요? [AI뉴스] 요즘 딥러닝 논문들 방향이 좀 달라졌더라고요 [프롬프트] AI한테 물어보는 방식 바꿔보니까 답의 질이 확 달라지더라고요 [프롬프트] 코드 리뷰 요청할 때 쓸 만한 프롬프트 있으신가요? [AI뉴스] 요즘 AI 계열 대기업들 움직임이 정신없네요 [AI뉴스] 올해 LLM 모델들 계속 쏟아지고 있네요 [AI뉴스] 요즘 LLM 모델들이 쏟아져 나오는데 뭘 써야 할지 모르겠어요 [프롬프트] 업무 지시사항을 프롬프트로 변환하니까 결과가 달라지네요 [프롬프트] 디자인 피드백 받을 때 쓸만한 프롬프트 있을까요? [기술 Q&A] LLM fine-tuning할 때 LoRA vs full fine-tuning 뭐가 더 낫나요
AI서비스

요즘 오픈소스 LLM이 진짜 무섭긴 하네...

현실주의자 2026.07.08 07:04 조회 413 추천 14 댓글 2건
최근 몇 달사이 DeepSeek R1, Gemma 3, Qwen 같은 오픈소스 모델들이 진짜 미쳐가고 있더라고요. DeepSeek-R1이 2025년 1월에 공개됐는데, V3가 비용을 흔들었다면 R1은 추론 모델 카테고리의 폐쇄 독점을 깼습니다. 구독료 내는 거 생각하면 진짜 뭐하는 짓인지 싶어요.

R1-Distill-Qwen-32B가 단일 H100 한 장에 들어가는 32B로 OpenAI o1-mini 클래스 추론을 한다는 게 완전 파격적이네요. 그리고 Qwen3.5-9B가 120B 모델을 이긴다니까 이제 모델 크기가 의미 있나 싶은 생각도 들고요.

Google Gemma 3은 2025년 3월에 출시됐고, 그 시점부터 "단일 GPU에 들어가는 멀티모달"이 새로운 베이스라인이 됐다고 하더라고요. 이제 Llama 4, Gemma 3, Mistral Large 3 같은 모델들이 상용 모델과 경쟁할 수 있음을 증명했고, AI의 미래는 더 이상 특정 기업의 독점물이 아니라는 분위기까지 나오니까요.
추천 14 비추천 0
댓글 2

댓글목록

profile_image
딥러닝장인
진짜 오픈소스 속도가 미쳤네요 ㅋㅋ
profile_image
코드리뷰어
맞네요. 예전에 이런 삽질을 했는데 비싼 구독료 내고 쓰다가 오픈소스 모델 성능 올라오는 거 보고 허탈했거든요 ㅋㅋ 이제 진짜 개인 서버에서도 충분히 괜찮은 수준의 모델 돌릴 수 있게 됐으니 앞으로 어떻게 될지 궁금하네요.