All news
YouTubeExternal · Video
[노정석] DeepSeek-V4 논문 읽기
DeepSeek‑V4를 집중 리뷰합니다. GPT‑5.5 출시와 구글 클라우드 넥스트 등 이슈를 짚은 뒤, DeepSeek‑V4가 보여준 모델 규모 확장(1.6T)과 sparse attention·mHC·Muon optimizer 같은 핵심 변화가 성능과 비용(연산·KV cache) 구조를 어떻게 바꿨는지 깊게 파고듭니다. 특히 long‑context 학습/추론에서 비용을 크게 낮춘 설계와, 중국 프론티어 랩들의 경쟁 구도가 어디까지 왔는지를 기술적 관점에서 함께 살펴봅니다.
Related models
