N
Hacker Next
new
past
show
ask
show
jobs
submit
login
▲
Show HN: Minimal LLM Post-Training Experiments on an 8GB GPU (SFT, DPO, GRPO)
(
github.com
)
21 points by
popopanda
1 days ago
|
0 comments
add comment
Rendered at 23:41:16 GMT+0000 (Coordinated Universal Time) with Cloudflare Workers.
popopanda 1 days ago
[-]
[flagged]