logoalt Hacker News

aurareturn • yesterday at 11:47 AM • 0 replies • view on HN

Models are likely already doing this inside AI labs because it can be hundreds of millions of dollars for every percentage point increase in hardware inference efficiency.