logoalt Hacker News

lmeyerovtoday at 3:33 AM0 repliesview on HN

Interestingly, while we don't fine-tune generative models for Louie.ai, we found fine-tuning embedding models to be a major $ saver. Instead of 1K-2K wide frontier embedding vector lens... Just 64. Huge savings on vector DB $$$.

I'm curious how that works with something like turboquant. Not needed any more, still dominant, better together, ... .