DeepSeek V4 Flash와 로컬 LLM, DGX Spark 열풍
출연자
쇼 노트
이번 에피소드에서는 2026년 8월 15~16일 동국대학교에서 열리는 PyCon Korea 2026의 프로그램과 44bits 부스, 발표·딥다이브·스프린트 참여 소식을 소개합니다. 현장에서 만날 수 있는 프로그램과 이동·주차 같은 실용적인 정보도 함께 짚습니다.
본편에서는 DeepSeek-V4-Flash-0731을 중심으로 오픈웨이트 모델이 상용 모델을 얼마나 빠르게 따라잡고 있는지 이야기합니다. GLM과 Kimi 등 다른 모델과 비교하고, 양자화·VRAM·KV 캐시·프리필 지연, 추론 속도와 API 가격을 살펴보며 개인이 로컬 LLM을 운용할 때 부딪히는 현실적인 한계를 다룹니다.
이어 MiniMax M3/H3와 영상 생성 모델, 급격한 모델 출시 경쟁과 AI 기반 개발 방식의 변화를 논의합니다. 데이터 공유에 따른 API 할인, Grok의 X 검색과 프라이버시, NVIDIA DGX Spark의 구매·클러스터 구성·중고 가격까지 개인용 AI 장비 시장의 현재를 정리합니다.
- PyCon Korea 2026 — 이번 에피소드에서 소개한 파이썬 커뮤니티 행사
- DeepSeek-V4-Flash-0731 — 로컬 실행과 성능을 중심으로 이야기한 오픈웨이트 모델
- DeepSeek — DeepSeek의 공식 웹사이트
- GLM-5 — 함께 비교한 오픈웨이트 모델
- Kimi-K3 — 중국 AI 모델 경쟁을 이야기하며 언급
- MiniMax-M3 — MiniMax의 모델 출시와 영상 생성 기술을 이야기하며 언급
- Grok — X 검색과 리서치 활용, 데이터 공유와 프라이버시를 이야기하며 언급
- NVIDIA DGX Spark — 구매와 다중 연결, 중고 시장을 이야기하며 언급
- OpenRouter — 모델별 API 가격과 사용 경험을 이야기하며 언급
- Artificial Analysis — 모델 성능과 가격 비교를 이야기하며 언급
추가 정보
- 녹음 날짜 : 2026-08-06
- 길이 : 01:15:26