Tagged articles

Sampling Diversity

2 articles · Page 1 of 1
Data Party THU
Data Party THU
Jul 7, 2026 · Artificial Intelligence

Parallel Decoding for Large Language Models: Balancing Inference Speed and Sampling Diversity in E‑GRM

The article presents an engineering analysis of the E‑GRM framework, detailing how parallel decoding, a temperature‑ladder sampling strategy, and batch‑parallel KV‑Cache sharing achieve low‑latency, high‑diversity inference while preserving consensus‑driven routing accuracy.

Batch ParallelismConsensus RoutingE‑GRM
0 likes · 14 min read
Parallel Decoding for Large Language Models: Balancing Inference Speed and Sampling Diversity in E‑GRM
Baobao Algorithm Notes
Baobao Algorithm Notes
Jun 13, 2025 · Artificial Intelligence

How GVPO Improves LLM Fine‑Tuning: Stable, Sample‑Rich Policy Optimization

The article introduces GVPO, a Group Variance Policy Optimization method that uniquely achieves KL‑constrained reward maximization, supports diverse sampling distributions, and resolves instability and inefficiency issues found in GRPO and traditional policy‑gradient approaches for large language model post‑training.

GVPOKL constraintPolicy Optimization
0 likes · 9 min read
How GVPO Improves LLM Fine‑Tuning: Stable, Sample‑Rich Policy Optimization