Charlie Leeming

About

Passionate about Model Build and Model serve efficiency: Automating GPU right sizing, max TPS at req'd latency, lowest Cost/energy per Token

Events