Back to Home
AI on Medium··Industry Media

Ce que personne ne surveille dans vos pipelines LLM et qui coûte cher

中文摘要

生产中AI项目通常只监控延迟、token成本和HTTP错误率。

English Summary

Production AI projects often only monitor latency, token cost, and HTTP error rates.

Original Excerpt

Dans la majorité des projets IA en production, les équipes ont instrumenté la latence, le coût par token, le taux d’erreur HTTP. Ce… Continue reading on Medium »