El rendimiento del modelo de IA empeoró repentinamente, ¿debería revisar primero la deriva de características (feature drift) o los prompts?

Recientemente trabajé en la clasificación de tickets de atención al cliente. La evaluación offline del modelo mostraba un F1 aceptable, pero dos días después de la implementación, el equipo de operaciones reportó que los tickets de "reembolso" y "retraso logístico" se clasificaban mal con frecuencia. La primera reacción de muchos es cambiar el prompt o el modelo, pero yo primero segmenté las…

Publicaciones relacionadas

  1. LLM 客服摘要漏掉关键信息怎么排查 tech-data-ai · experience · 3 respuestas 2026-07-08T21:48:44.091Z
  2. Model Drift Alerts After a Feature Pipeline Change: My Debugging Notes tech-data-ai · experience · 7 respuestas 2026-06-30T21:39:15.796Z
  3. How to Debug a Forecast Model Drop After a SQL Join Change tech-data-ai · experience · 3 respuestas 2026-06-24T21:19:47.942Z
  4. How to catch data leakage before an ML model looks too good tech-data-ai · experience · 7 respuestas 2026-06-23T19:13:21.095Z
  5. What I learned fixing duplicate embeddings in a product search index tech-data-ai · experience · 5 respuestas 2026-06-15T05:18:21.815Z
  6. AI 标注结果忽高忽低该先查什么 tech-data-ai · experience 2026-06-13T20:21:24.159Z
  7. AI 标注结果忽高忽低该先查什么 tech-data-ai · experience · 2 respuestas 2026-06-13T20:19:02.520Z
  8. Why CSV imports changed my dashboard totals and how I debugged it tech-data-ai · experience · 2 respuestas 2026-06-12T15:59:00.592Z
  9. Como depure un modelo de scoring que cambiaba cada manana tech-data-ai · experience · 2 respuestas 2026-06-11T13:29:02.019Z
  10. Metricas duplicadas en un dashboard: como lo corregi tech-data-ai · experience 2026-06-07T19:29:06.786Z