잡담
QWEN3.8은 크기가 엄청 남미다
남극백곰

Lv.1 남극백곰 (114.♡.188.135)

2026년 7월 20일 AM 10:22

조회 1,269 공감 0

KIMI-K3 가 2.8T QWEN3.8이 2.4T 중국이 무섭게 치고 올라오는데

일반인들이 사용할 수 없는 파라미터라... 3.7 버전도 아직 API용 아니면 사용을 못 하는데 일반인들이 사용할 수 있는 작은 파라미터 가진 버전도 공개해 주세요 ㅠㅠ

중국정부에서 외국으로 서비스 하는건 중국내부에서 만큼 싸게 주면 안 된다 중국내부에서 사용하고 남은거만 외국에 서비스 해라 이런식으로 말 했던걸로 아는데.... 로컬모델만 주세요

댓글 (6)

  • 꼬부기부

    꼬부기부 Lv.1

    07.20 · 211.♡.204.156 · 수정됨 · 07.20

    2.4T open weight이면 기업아니면 운영이 불가능하겠네요.

  • 빅데이트

    빅데이트 Lv.1 → 꼬부기부

    07.20 · 112.♡.148.44

    대기업 아니면 힘들거 같습니다. 근데 대기업이 이걸 쓸까 싶구요. 비용 때문에 온프레미스 구성한다?

  • YBman

    YBman Lv.1

    07.20 · 218.♡.152.147

    중소형 모델은 qwen3.7도 안내준거 보면 3.8도 안내줄 것 같아요. qwen3.6 시리즈는 제 생각에는 알리바바의 실수인 듯합니다. 좋은 의미로요.. 너무 좋은 모델을 만들었고 그것을 배포해버렸고... 게임은 끝났고... 지금 한달이 멀다하고 바뀌는 llm판도에서 qwen3.6-27b는 압도적인 성능을 아직도 유지하고 있죠. 다른 것들은 아직도 못따라오고 있습니다. 여러모로 대단한 것 같아요..

  • 도깨비방뫙

    도깨비방뫙 Lv.1

    07.20 · 114.♡.1.156

    3.7 부터 공개정책을 바꿨다고 했던 기억이 납니다 ㅜㅜ GPU 중고가 좀 떨어질려나요. 팔아버릴까 ㅋ

  • YBman

    YBman Lv.1 → 도깨비방뫙

    07.20 · 218.♡.152.147

    저는 dual rtx3090사용중인데 가능하면 하나 만 더 있으면 좋겠다는 생각이 들 때도 있습니다. local에서 쓸 때 qwen과 gemma dense 모델을 양쪽에 하나씩 놓고 (똑똑한)qwen 먼저 작업하고, (말잘하고 똘똘한)gemma가 review하고 그걸 다시 qwen이 종합하는 식으로 구현하고 있습니다. 두개만 해도 gpu가 거의 꽉 차버려서 다른 것을 넣을 곳이 마땅치 않아요.
    개인적으로는 말로 풀어나가고 싶어서 음성인식 모듈도 gpu에 올리고 싶기도 하구요. data가 점 점 쌓이면서 이 데이터에 대한 상세하고 통찰력있는 검색 능력을 높이고 싶은데 이 검색을 하는 것도 전용 (embedding) gpu가 잘하더라구요. 적어도 qwen3 8b정도는 써야 검색이 좋아지는데 그러면 아무리 양자화를 해도 적어도 5-6gb는 vram을 차지하게 되버립니다.
    하나만 포기하면 될 것 같긴한데 local로 cloud 수준의 결과를 얻으려하니 결국에는 gpu를 처발처발 해야 하는 상황이라고 볼 수 있죠... 3090이 딱 가성비가 제일 좋은 것 같아요. (물론 다른 것은 써본 적이 없습니다. 본적도 없습니다..ㅎㅎ)

  • 고소미

    고소미 Lv.1

    00:53 · 180.♡.204.252

    자자 여러분 이제 램들 더 사주세요. 이래도 램이 필요 없습니까 ㅠㅠ

댓글을 작성하려면 이 필요합니다.