Hacker News 의견들 모델 가중치가 방금 공개됨: https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 DwarfStar 양자화 버전이 기대됨. 128GB MacBook Pro에서 DeepSeek V4 Flash 미리보기를 몇 달간 주력 코딩 에이전트로 사용했는데, 거의 모든 지표에서 GLM 5.2보다 뛰어나 보임 128×128 행렬 곱셈 프리미티브를 갖춘 하드웨어 가속기를 겨냥하는데, H100의 Warp Group Matrix Multiply Accumulate를 뜻하는지 궁금함 165GB 미만 Unsloth GGUF라면 256GB RAM을 갖춘 CPU 전용 시스템 대부분에서 실행 가능함. llama-server로 32GB·48GB·96GB GPU에 최대한 올리고 나머지를 시스템 DRAM에 배치하는 혼합 구성도 가능함 https://huggingface.co/unsloth/DeepSeek-V4-Flash-0731-GGUF 새 DeepSeek 모델은 크리스마스 선물 같음. 저가 API 모델은 DeepSeek가 가장 잘하며, VRAM 가격이 로컬 실행이 가능할 만큼 내려가기 전까지는 이 방식이 최선임 보조금에 의존하는 구독 모델은 오래가기 어렵고, API 과금이 지속 가능한 사업 모델에 더 가까워 보임 프로젝트 하나에 DeepSeek를 쓰는데, 수천만 토큰을 몇 센트에 사용할 수 있다는 점이 놀라움. 모든 작업에 적합하지는 않지만 특정 작업은 사실상 무료에 가까운 비용으로 탁월하게 처리함 중국이 메모리와 연산 하드웨어를 따라잡아 미국 기업을 가격과 성능 모두에서 압도할 날이 기대됨 동료 개발자들은 Claude 토큰을 한 시간 만에 소진한다고 불평하지만, 나는 DS Flash를 하루 종일 사용함. 가끔 틀리면 그때 어려운 작업에만 Claude 같은 모델을 꺼내면 됨 토큰당으로 따져도 DeepSeek API가 구독보다 비용 효율적일 가능성이 큼. 직접 시험해 보니 Flash는 지시 준수 능력이 크게 좋아졌고 더 능동적으로 변해, 현재 비용 효율 면에서 견줄 모델이 거의 없음 직접 가격을 살펴보면 GPT 5.6 Luna와 같은 결과를 내려면 토큰이 5배 필요하고 초당 토큰 수도 훨씬 낮음. 그래도 DeepSeek의 압박 덕분에 기존 업체들이 계속 최적화하게 된다는 효과는 분명함 기존 주소는 404이며 올바른 URL은 다음으로 보임: https://artifici...
DeepSeek V4 Flash 0731의 지능·성능·가격 분석
3 weeks ago
21
Related
SSL에 대해 배운 모든 것이 더는 유효하지 않음 [유튜브]
5 hours ago
2
YC CEO Garry Tan이 말하는 창업자의 새로운 규칙 [유튜브]
5 hours ago
1
Computer Use와 Skills/Files API로 프로덕션 에이전트 구축하기
5 hours ago
1
Rust nightly, 차세대 트레이트 솔버 기본 활성화
6 hours ago
1
KDE에 Btrfs 스냅샷을 통합하는 KIO Snapshot
6 hours ago
1
더 나은 배터리
6 hours ago
1
Rust 1.98.0 발표
6 hours ago
1
Tips
click
Popular
마키나락스, 중견 제조사 현장에 AI 네이티브 팩토리 구축한다
4 weeks ago
64
제니, 빌보드 라디오 차트 1위…'골든' 이어 두 번째
3 weeks ago
62
라온시큐어 화이트해커 23명, 국제 해킹 대회 '데프콘 CTF 2026' 본선행
3 weeks ago
56
'산골총각 영웅' 차승원·김도훈 합류…임영웅과 찰떡+힐링 케미
3 weeks ago
46
© Clint IT 2026. All rights are reserved

![[테크 차이나] DeepSeek V4 Flash 1위… 중국 모델 강세 지속(OpenRouter 주간 AI 모델 사용량 순위)](https://img.etnews.com/news/article/2026/08/06/news-p.v1.20260806.379c2eee15bb4be5b29d934a203a6106_Z1.jpg)








English (US) ·