남극백곰 (114.♡.188.135)
2026년 7월 20일 AM 10:22

KIMI-K3 가 2.8T QWEN3.8이 2.4T 중국이 무섭게 치고 올라오는데
일반인들이 사용할 수 없는 파라미터라... 3.7 버전도 아직 API용 아니면 사용을 못 하는데 일반인들이 사용할 수 있는 작은 파라미터 가진 버전도 공개해 주세요 ㅠㅠ
중국정부에서 외국으로 서비스 하는건 중국내부에서 만큼 싸게 주면 안 된다 중국내부에서 사용하고 남은거만 외국에 서비스 해라 이런식으로 말 했던걸로 아는데.... 로컬모델만 주세요
댓글 (6)
-
꼬꼬부기부
07.20 · 211.♡.204.156 · 수정됨 · 07.20
-
빅빅데이트
→ 꼬부기부
07.20 · 112.♡.148.44
대기업 아니면 힘들거 같습니다. 근데 대기업이 이걸 쓸까 싶구요. 비용 때문에 온프레미스 구성한다?
-
YYBman
07.20 · 218.♡.152.147
중소형 모델은 qwen3.7도 안내준거 보면 3.8도 안내줄 것 같아요. qwen3.6 시리즈는 제 생각에는 알리바바의 실수인 듯합니다. 좋은 의미로요.. 너무 좋은 모델을 만들었고 그것을 배포해버렸고... 게임은 끝났고... 지금 한달이 멀다하고 바뀌는 llm판도에서 qwen3.6-27b는 압도적인 성능을 아직도 유지하고 있죠. 다른 것들은 아직도 못따라오고 있습니다. 여러모로 대단한 것 같아요..
-
도도깨비방뫙
07.20 · 114.♡.1.156
3.7 부터 공개정책을 바꿨다고 했던 기억이 납니다 ㅜㅜ GPU 중고가 좀 떨어질려나요. 팔아버릴까 ㅋ
-
YYBman
→ 도깨비방뫙
07.20 · 218.♡.152.147
저는 dual rtx3090사용중인데 가능하면 하나 만 더 있으면 좋겠다는 생각이 들 때도 있습니다. local에서 쓸 때 qwen과 gemma dense 모델을 양쪽에 하나씩 놓고 (똑똑한)qwen 먼저 작업하고, (말잘하고 똘똘한)gemma가 review하고 그걸 다시 qwen이 종합하는 식으로 구현하고 있습니다. 두개만 해도 gpu가 거의 꽉 차버려서 다른 것을 넣을 곳이 마땅치 않아요.
개인적으로는 말로 풀어나가고 싶어서 음성인식 모듈도 gpu에 올리고 싶기도 하구요. data가 점 점 쌓이면서 이 데이터에 대한 상세하고 통찰력있는 검색 능력을 높이고 싶은데 이 검색을 하는 것도 전용 (embedding) gpu가 잘하더라구요. 적어도 qwen3 8b정도는 써야 검색이 좋아지는데 그러면 아무리 양자화를 해도 적어도 5-6gb는 vram을 차지하게 되버립니다.
하나만 포기하면 될 것 같긴한데 local로 cloud 수준의 결과를 얻으려하니 결국에는 gpu를 처발처발 해야 하는 상황이라고 볼 수 있죠... 3090이 딱 가성비가 제일 좋은 것 같아요. (물론 다른 것은 써본 적이 없습니다. 본적도 없습니다..ㅎㅎ) -
고고소미
00:53 · 180.♡.204.252
자자 여러분 이제 램들 더 사주세요. 이래도 램이 필요 없습니까 ㅠㅠ
댓글을 작성하려면 이 필요합니다.
2.4T open weight이면 기업아니면 운영이 불가능하겠네요.