AI 资讯 Show HN: Minimal LLM Post-Training Experiments on an 8GB GPU (SFT, DPO, GRPO) popopanda 2026年08月01日 20:30 0 次阅读 来源:HackerNews 本文内容来源于互联网,版权归原作者所有 查看原文 # hackernews