Hacker News 의견들 모델 가중치가 방금 공개됨: https://huggingface.co/deepseek-ai/DeepSeek-V4-Flash-0731 DwarfStar 양자화 버전이 기대됨. 128GB MacBook Pro에서 DeepSeek V4 Flash 미리보기를 몇 달간 주력 코딩 에이전트로 사용했는데, 거의 모든 지표에서 GLM 5.2보다 뛰어나 보임 128×128 행렬 곱셈 프리미티브를 갖춘 하드웨어 가속기를 겨냥하는데, H100의 Warp Group Matrix Multiply Accumulate를 뜻하는지 궁금함 165GB 미만 Unsloth GGUF라면 256GB RAM을 갖춘 CPU 전용 시스템 대부분에서 실행 가능함. llama-server로 32GB·48GB·96GB GPU에 최대한 올리고 나머지를 시스템 DRAM에 배치하는 혼합 구성도 가능함 https://huggingface.co/unsloth/DeepSeek-V4-Flash-0731-GGUF 새 DeepSeek 모델은 크리스마스 선물 같음. 저가 API 모델은 DeepSeek가 가장 잘하며, VRAM 가격이 로컬 실행이 가능할 만큼 내려가기 전까지는 이 방식이 최선임 보조금에 의존하는 구독 모델은 오래가기 어렵고, API 과금이 지속 가능한 사업 모델에 더 가까워 보임 프로젝트 하나에 DeepSeek를 쓰는데, 수천만 토큰을 몇 센트에 사용할 수 있다는 점이 놀라움. 모든 작업에 적합하지는 않지만 특정 작업은 사실상 무료에 가까운 비용으로 탁월하게 처리함 중국이 메모리와 연산 하드웨어를 따라잡아 미국 기업을 가격과 성능 모두에서 압도할 날이 기대됨 동료 개발자들은 Claude 토큰을 한 시간 만에 소진한다고 불평하지만, 나는 DS Flash를 하루 종일 사용함. 가끔 틀리면 그때 어려운 작업에만 Claude 같은 모델을 꺼내면 됨 토큰당으로 따져도 DeepSeek API가 구독보다 비용 효율적일 가능성이 큼. 직접 시험해 보니 Flash는 지시 준수 능력이 크게 좋아졌고 더 능동적으로 변해, 현재 비용 효율 면에서 견줄 모델이 거의 없음 직접 가격을 살펴보면 GPT 5.6 Luna와 같은 결과를 내려면 토큰이 5배 필요하고 초당 토큰 수도 훨씬 낮음. 그래도 DeepSeek의 압박 덕분에 기존 업체들이 계속 최적화하게 된다는 효과는 분명함 기존 주소는 404이며 올바른 URL은 다음으로 보임: https://artifici...
DeepSeek V4 Flash 0731의 지능·성능·가격 분석
2 days ago
10
Related
Karpathy의 펠리컨
4 hours ago
2
실리콘밸리의 창업자 고기 분쇄기
5 hours ago
4
BMW, 구매한 차량 화면에 Spider-Man 광고 배포
6 hours ago
1
RamenHaus
7 hours ago
3
Wikimedia Foundation, 노조 인정 거부하고 노조 저지 전문 로펌 선임
8 hours ago
4
Matrix에서의 일주일
8 hours ago
3
Show HN: 엔지니어를 꿈꾸는 15살인 제가 만든 사이클로이드 감속기
9 hours ago
8
Show GN: 클로드코드 세션 탐색기 만들어 봤습니다.
9 hours ago
4
Tips
click
Trending
Popular
필리핀 “中 관영매체, 필리핀인을 원숭이로 묘사…인종차별”
2 weeks ago
124
北핵실험 연구한 美학자, 中에 20개월째 구금…외교문제 비화
2 weeks ago
104
디노티시아, ICML26서 ‘STAR-KV’ 논문 발표··· ‘KV 캐시 75% 압축에도 성능 보존’
3 weeks ago
62
삼일PwC, AI 기반 '지속가능성 공시 통합 플랫폼' 출시
3 weeks ago
59
© Clint's Theme Park 2026. All rights are reserved










English (US) ·