Faltaba la tercera pata: audio pasaba por Whisper, imagen por OCR, y un PDF o
un Word adjunto se ignoraba en silencio. Ahora hay un interruptor por canal
—"Leer archivos adjuntos"— y los documentos que llegan por Telegram o WhatsApp
se convierten a texto antes de pasar al agente.
PDF se lee con stdlib cuando el documento es digital (facturas, cotizaciones,
lo exportado por cualquier programa) y cae al OCR si es un escaneo. Word .docx
es un zip con XML adentro; texto plano, CSV y JSON van directo.
El agente recibe el contenido con contexto ("el cliente adjuntó X, y escribió
Y"), no el chorizo pelado: sin eso el modelo contesta como si el cliente
hubiera tipeado una factura.
De paso la importación de plantillas gana PDF, que usa el mismo extractor.
Co-Authored-By: Claude Opus 5 <noreply@anthropic.com>
17 lines
649 B
HTML
17 lines
649 B
HTML
<!doctype html>
|
|
<html lang="es">
|
|
<head>
|
|
<meta charset="UTF-8" />
|
|
<meta name="viewport" content="width=device-width, initial-scale=1.0" />
|
|
<title>uMind Studio</title>
|
|
<script type="module" crossorigin src="/orchestrator/assets/index-CbuoSeqG.js"></script>
|
|
<link rel="stylesheet" crossorigin href="/orchestrator/assets/index-DUjBJRtl.css">
|
|
</head>
|
|
<!-- Sin clase de fondo: el color lo pone body en style.css desde los tokens,
|
|
que son los que cambian con el tema. Una utilidad acá le ganaba a la
|
|
capa base y dejaba el fondo claro también en modo oscuro. -->
|
|
<body>
|
|
<div id="app"></div>
|
|
</body>
|
|
</html>
|