카테고리
transformers
-

gpt-oss가 보여준 transformers 최적화의 실전 단서
Hugging Face의 gpt-oss 최적화 글을 바탕으로 transformers의 커널 허브, MXFP4, Flash Attention 3를 정리합니다. torch.compile은 2–10× 향상을 언급합니다.
-

OpenAI GPT OSS가 보여준 공개 모델 기준
OpenAI의 GPT OSS 공개를 해석합니다. gpt-oss-120b와 gpt-oss-20b 두 모델, 117B 파라미터, 4비트 MXFP4, 단일 H100 GPU, 16GB 메모리 조건이 실무 배포에 주는 뜻을 정리합니다.
-

huggingface_hub v1.0가 오픈 머신러닝의 기반이 된 이유
huggingface.co의 huggingface_hub v1.0 글을 분석합니다. 5년 개발과 200,000개 의존 라이브러리, over 2 million 모델, httpx·hf CLI·hf_xet 전환이 실무에 주는 의미와 transformers 예외를 함께 정리합니다.