[控场AI]
论文arXiv:2610.00049v1 / Fast Polynomial Transcendentals for LLMs

多项式逼近LLM加速论文

研究用短多项式程序逼近GPU超越函数(sigmoid、tanh、SiLU等),将SFU负载转移至FMA单元,在NVIDIA GB200上实现训练吞吐最高8%提升的学术论文

来源文章