Es la base del cobro por uso: hasta ahora no había ninguna medición de consumo en todo el repo. - UmindUso registra cada evento facturable con el costo YA calculado al precio vigente del plan. Congelarlo evita que subir un precio revalúe consumo pasado, que haría indefendible una factura ante un reclamo. - callAI devuelve los tokens que reportó el proveedor (campo usage, igual en todos los OpenAI-compatibles; input+output en Anthropic). Se mide cada ronda de tool-calling, no solo la última: todas gastan tokens. - ExtraerTextoOCR y TranscribirAudioSelfHosted reciben agenteID; 0 = no medir, que es lo que pasan los botones "Probar" del panel de staff. - Aviso al superar el tope del plan, una vez por mes y sin cortar el servicio. El flag de "ya avisé" es en memoria a propósito. - GET /app/umind/uso con filtros de fecha: resumen por tipo + detalle. - Test del cálculo de costo por tipo, incluida fracción de 1k tokens y tenant sin plan. Co-Authored-By: Claude Sonnet 5 <noreply@anthropic.com>
72 lines
2.0 KiB
Go
72 lines
2.0 KiB
Go
package services
|
|
|
|
import (
|
|
"bytes"
|
|
"encoding/base64"
|
|
"encoding/json"
|
|
"fmt"
|
|
"io"
|
|
"net/http"
|
|
"time"
|
|
|
|
"github.com/sujit-baniya/fiber-boilerplate/pkg/models"
|
|
)
|
|
|
|
var ocrHTTPClient = &http.Client{Timeout: 30 * time.Second}
|
|
|
|
// ExtraerTextoOCR manda una imagen al servicio propio de OCR y devuelve el
|
|
// texto extraído. mimeType ej: "image/png", "image/jpeg".
|
|
//
|
|
// agenteID identifica a quién cobrarle la imagen procesada; 0 = no medir, que
|
|
// es lo que pasa el botón "Probar" del panel de staff (no es de ningún cliente).
|
|
func ExtraerTextoOCR(agenteID uint, imagenBytes []byte, mimeType string) (string, error) {
|
|
cfg, err := models.GetOcrConfig()
|
|
if err != nil {
|
|
return "", fmt.Errorf("el servicio de OCR no está configurado (Integraciones → OCR)")
|
|
}
|
|
|
|
body, err := json.Marshal(map[string]string{
|
|
"image_base64": base64.StdEncoding.EncodeToString(imagenBytes),
|
|
"mime_type": mimeType,
|
|
})
|
|
if err != nil {
|
|
return "", err
|
|
}
|
|
|
|
req, err := http.NewRequest(http.MethodPost, cfg.BaseURL, bytes.NewReader(body))
|
|
if err != nil {
|
|
return "", err
|
|
}
|
|
req.Header.Set("Authorization", "Bearer "+cfg.Token)
|
|
req.Header.Set("Content-Type", "application/json")
|
|
|
|
resp, err := ocrHTTPClient.Do(req)
|
|
if err != nil {
|
|
return "", fmt.Errorf("no se pudo contactar el servicio de OCR: %w", err)
|
|
}
|
|
defer resp.Body.Close()
|
|
raw, _ := io.ReadAll(io.LimitReader(resp.Body, 2*1024*1024))
|
|
|
|
if resp.StatusCode < 200 || resp.StatusCode >= 300 {
|
|
return "", fmt.Errorf("el servicio de OCR respondió %d: %s", resp.StatusCode, string(raw))
|
|
}
|
|
|
|
var out struct {
|
|
Success bool `json:"success"`
|
|
Text string `json:"text"`
|
|
Error string `json:"error"`
|
|
}
|
|
if err := json.Unmarshal(raw, &out); err != nil {
|
|
return "", fmt.Errorf("respuesta inesperada del servicio de OCR: %s", string(raw))
|
|
}
|
|
if !out.Success {
|
|
msg := out.Error
|
|
if msg == "" {
|
|
msg = "el servicio de OCR no pudo procesar la imagen"
|
|
}
|
|
return "", fmt.Errorf("%s", msg)
|
|
}
|
|
RegistrarUso(agenteID, models.UsoTipoOCR, 1, "imagen")
|
|
return out.Text, nil
|
|
}
|