Base de conocimiento
Enseña a tu Finn sobre tu negocio.
La Base de Conocimiento es donde guardas todo lo que tu Finn necesita saber sobre tu negocio. Menú, precios, horarios, políticas, preguntas frecuentes: cualquier cosa que puedan preguntar quienes llaman. Cuando alguien hace una pregunta, el Finn saca la respuesta de aquí.
No le des muchas vueltas. La mayoría de los usuarios empieza subiendo un PDF (sus preguntas frecuentes o un folleto de producto) y con eso basta para que el Finn resuelva el 80 % de las preguntas. Siempre puedes añadir más después.
Privacidad: todo lo que pongas en la Base de Conocimiento se puede consultar en cada llamada que atienda este Finn. No pongas aquí datos de cada persona (como saldos de cuenta o el estado de un pedido); para eso, usa un webhook de consulta de datos en vivo.
Dónde configurarlo
Create New Finn → pestaña Knowledge Base. También se puede editar después en View All Finn → [Finn] → Edit → Knowledge Base.
Tres fuentes, un índice
Puedes combinar tres tipos de material de origen:
- Archivos subidos: PDF, DOCX, Markdown, texto plano.
- Texto pegado: copia y pega contenido directamente en el editor.
- Importaciones de sitios web: indica una URL y la plataforma rastrea e indexa las páginas.
Las tres alimentan un único índice consultable por Finn. Al momento de la llamada, el Finn no sabe (ni le importa) de dónde salió un fragmento.
Archivos subidos
Formatos admitidos
| Formato | Notas |
|---|---|
| Ideal para manuales de producto, documentos de políticas y folletos | |
| DOCX | Conocimiento editable que mantiene el equipo |
| Markdown (.md) | Muy útil para documentación técnica |
| Texto plano (.txt) | Sencillo y fiable |
Límites
- Tamaño máximo por archivo: 25 MB.
- Máximo de archivos por Finn: 100.
- Tamaño total indexado: 500 MB por Finn (varía según el plan).
Qué se indexa
La plataforma extrae texto, tablas y encabezados. Las imágenes y los PDF escaneados sin capa de texto se omiten: pásalos antes por un OCR externo.
Buenas prácticas
- Varios archivos pequeños es mejor que un PDF enorme. El sistema de recuperación funciona mejor con documentos acotados.
- Elimina el relleno: encabezados, pies de página y números de página añaden ruido.
- Un solo tema por archivo: así es más fácil actualizarlo sin reindexar todo.
Texto pegado
Para contenido rápido que no merece un archivo. Límites: 100 000 caracteres por pegado y 10 pegados por Finn.
Úsalo para:
- Fragmentos de preguntas frecuentes.
- Descripciones breves de productos.
- Datos que cambian a diario (el código promocional de hoy, los tiempos de espera actuales), aunque para datos realmente en vivo conviene usar una tarea de Webhook.
Importaciones de sitios web
Proporciona una URL. La plataforma rastrea el sitio e indexa las páginas.
Configuración
| Opción | Predeterminado | Notas |
|---|---|---|
| Profundidad máxima | 2 | Cuántos niveles de enlaces seguir desde la raíz. |
| Páginas máximas | 100 | Límite absoluto, independientemente de la profundidad. |
| Rutas incluidas | * | Glob para incluir en la lista blanca (p. ej., /help/*). |
| Rutas excluidas | /login*, /cart* | Glob para incluir en la lista negra. |
| Frecuencia de rastreo | semanal | O manual. |
Qué funciona bien
- Centros de ayuda y páginas de preguntas frecuentes de acceso público.
- Catálogos de productos con HTML limpio.
- Páginas de marketing renderizadas de forma estática.
Qué no funciona
- Sitios que requieren inicio de sesión.
- Aplicaciones de página única pesadas donde el contenido se renderiza con JS tras cargar la página (usa la carga de archivos en su lugar).
- Sitios que bloquean rastreadores mediante robots.txt (la plataforma lo respeta).
Cómo funciona la recuperación durante la llamada
Cuando la persona que llama hace una pregunta:
- El Finn formula una consulta a partir de lo que dice la persona que llama.
- La plataforma busca en el índice (híbrido de vectores y palabras clave).
- Los N fragmentos coincidentes principales se insertan en el prompt del LLM.
- El Finn sintetiza una respuesta fundamentada en esos fragmentos.
Puedes inspeccionar lo que se recuperó en cada llamada en la pestaña Data Extractor Sidebar → Knowledge. Útil para depurar "¿por qué dijo eso el Finn?"
Ajustar la recuperación
Si el Finn da respuestas incorrectas o fuera de tema:
- Añade contenido más específico. Si "¿cuál es su política de reembolsos?" devuelve respuestas vagas, añade un archivo dedicado a la política de reembolsos.
- Elimina contradicciones. Dos archivos que dicen cosas distintas confunden la recuperación. Audítalos y concíliaos.
- Refuerza las restricciones del mensaje de bienvenida. Indica al Finn explícitamente qué está dentro del alcance. "Solo respondes preguntas sobre programación de citas. Cualquier otra cosa, transfiere a una persona."
- Reordenar. Los planes premium permiten definir la prioridad por fuente: los archivos más nuevos prevalecen sobre los antiguos.
Cuándo no usar la base de conocimiento
Algunos datos no deben estar aquí:
- Datos por interlocutor (saldos de cuenta, estado de pedidos): usa una tarea de Webhook para consultarlos en vivo.
- Datos sensibles (números de la seguridad social, números completos de tarjeta): nunca los pegues aquí. La KB es consultable en todas las llamadas.
- Contenido muy dinámico (precios que cambian cada hora): también es trabajo de un webhook.
La KB sirve para contexto de fondo que es igual para todos los interlocutores. Todo lo específico de un interlocutor o sensible al tiempo debe consultarse en vivo.
Reindexación
La plataforma reindexa:
- Automáticamente: al añadir, eliminar o editar una fuente.
- Según programación: en las importaciones de sitios web, según la frecuencia de rastreo.
- Manualmente: Base de conocimiento → Reindexar ahora. Fuerza una reconstrucción completa.
La reindexación suele tardar segundos (KB pequeñas) o unos minutos (500 MB).
Coste
El almacenamiento y las consultas de la base de conocimiento están incluidos en tu plan hasta los límites de tamaño indicados arriba. Superarlos requiere mejorar de plan: consulta Facturación →.
Siguiente
- Flujos de trabajo →: cuando la recuperación libre no es lo bastante estructurada.
- Integraciones →: consultas de datos en vivo mediante webhooks.
Was this page helpful?
Still stuck or have feedback?
Email [email protected] or use the chat bubble in the bottom-right corner — it's a Finn that knows the Academy cold.