{"schema_version":"1.0","type":"Article","canonical_url":"https://visteesto.com/nota/que-es-rag-ia-como-funciona","machine_urls":{"markdown":"https://visteesto.com/ai/article/que-es-rag-ia-como-funciona/markdown","json":"https://visteesto.com/ai/article/que-es-rag-ia-como-funciona/json"},"publisher":{"name":"VisteEsto","url":"https://visteesto.com","editor":"Martín Rodríguez","editorial_policy":"https://visteesto.com/politica-editorial","corrections_policy":"https://visteesto.com/correcciones"},"headline":"Qué es RAG en inteligencia artificial y cómo funciona","description":"Qué es RAG en inteligencia artificial y cómo funciona: busca información externa relevante, la agrega al contexto y luego genera una respuesta basada en ella.","dek":"La generación aumentada por recuperación conecta un modelo con documentos o bases de conocimiento. Puede mejorar actualidad y trazabilidad, pero una búsqueda mala también produce respuestas mal fundamentadas.","language":"es","section":"Tecnología","topic":"rag-inteligencia-artificial","tags":["RAG","Inteligencia artificial","LLM","Búsqueda"],"author":{"name":"Martin Rodriguez","profile_url":"https://visteesto.com/autor/martin-rodriguez"},"date_published":"2026-09-18T00:00:00.000Z","date_modified":"2026-09-18T00:00:00.000Z","search_intent":"explain","content_format":"brief","primary_query":"qué es RAG en inteligencia artificial y cómo funciona","intended_audience":"Personas que evalúan asistentes con documentos propios o quieren entender cómo un LLM usa información externa.","original_contribution":"VisteEsto convierte la arquitectura RAG en una cadena de calidad que permite separar errores de datos, recuperación, contexto y generación.","key_facts":[{"statement":"RAG combina la memoria paramétrica de un modelo con una memoria externa recuperable.","evidence_url":"https://arxiv.org/abs/2005.11401"},{"statement":"Un flujo RAG recupera información relevante y la agrega al contexto antes de generar una respuesta.","evidence_url":"https://cloud.google.com/use-cases/retrieval-augmented-generation"},{"statement":"Los documentos suelen dividirse y representarse mediante embeddings en un índice vectorial.","evidence_url":"https://docs.aws.amazon.com/prescriptive-guidance/latest/retrieval-augmented-generation-options/what-is-rag.html"},{"statement":"Actualizar la fuente externa permite cambiar el conocimiento disponible sin volver a entrenar el modelo base.","evidence_url":"https://docs.aws.amazon.com/prescriptive-guidance/latest/retrieval-augmented-generation-options/what-is-rag.html"}],"sections":[{"heading":"Qué es RAG y qué problema intenta resolver","paragraphs":["RAG significa Retrieval-Augmented Generation, o generación aumentada por recuperación. Es una arquitectura que combina un modelo generativo con un sistema de búsqueda: antes de responder, recupera fragmentos externos relacionados con la consulta y los incorpora al contexto que recibe el modelo.","El trabajo original de 2020 combinó memoria paramétrica, contenida en el modelo, con una memoria no paramétrica formada por un índice externo. En aplicaciones actuales, esa fuente puede ser una colección de manuales, políticas, artículos, fichas de productos o documentos internos."]},{"heading":"El recorrido desde los documentos hasta la respuesta","paragraphs":["Primero se preparan los documentos: se limpian, dividen en fragmentos y, a menudo, se convierten en representaciones numéricas llamadas embeddings. Cuando llega una pregunta, el buscador compara su significado con el índice y selecciona los fragmentos considerados más pertinentes.","Después, un orquestador agrega esos fragmentos a la consulta y envía el conjunto al modelo. El modelo genera la respuesta usando ese contexto. Las fuentes pueden adjuntarse como citas, pero esa trazabilidad depende de que la aplicación conserve la relación entre cada fragmento y su documento original."]},{"heading":"La cadena de calidad: recuperar antes de generar","paragraphs":["RAG no garantiza una respuesta correcta. Si el índice está desactualizado, los fragmentos son demasiado grandes o pequeños, los permisos filtran mal o la búsqueda recupera contenido irrelevante, el modelo parte de una base defectuosa. También puede ignorar evidencia o combinarla de forma incorrecta.","Para evaluarlo, separá recuperación y generación. Primero medí si aparecen los documentos que contienen la respuesta; después revisá si la respuesta respeta esos documentos, cita el origen correcto y reconoce cuando falta evidencia. Esa cadena permite detectar si el problema está en los datos, el buscador, el prompt o el modelo."]}],"sources":[{"name":"Lewis et al.: Retrieval-Augmented Generation for Knowledge-Intensive NLP Tasks","url":"https://arxiv.org/abs/2005.11401","kind":"primary"},{"name":"AWS Prescriptive Guidance: Understanding RAG","url":"https://docs.aws.amazon.com/prescriptive-guidance/latest/retrieval-augmented-generation-options/what-is-rag.html","kind":"primary"},{"name":"Google Cloud: What is Retrieval-Augmented Generation","url":"https://cloud.google.com/use-cases/retrieval-augmented-generation","kind":"primary"}],"primary_source_gap":null,"images":[{"url":"https://visteesto.com/media/que-es-rag-ia-como-funciona/cover.jpg","alt":"Flujo RAG con búsqueda contexto y modelo generativo","width":1200,"height":675,"creator":"VisteEsto","license":"VisteEsto editorial","licenseUrl":"https://visteesto.com/terminos","sourceUrl":"https://visteesto.com/que-es-rag-ia-como-funciona","caption":"RAG recupera información antes de pedirle al modelo que genere una respuesta."},{"url":"https://visteesto.com/media/que-es-rag-ia-como-funciona/inline-1.jpg","alt":"Documentos divididos e indexados para un sistema RAG","width":1200,"height":800,"creator":"VisteEsto","license":"VisteEsto editorial","licenseUrl":"https://visteesto.com/terminos","sourceUrl":"https://visteesto.com/que-es-rag-ia-como-funciona","caption":"Los documentos se preparan e indexan para recuperar fragmentos relevantes."},{"url":"https://visteesto.com/media/que-es-rag-ia-como-funciona/inline-2.jpg","alt":"Cadena de evaluación de recuperación contexto y generación","width":1200,"height":675,"creator":"VisteEsto","license":"VisteEsto editorial","licenseUrl":"https://visteesto.com/terminos","sourceUrl":"https://visteesto.com/que-es-rag-ia-como-funciona","caption":"Separar las etapas ayuda a encontrar dónde se origina una respuesta deficiente."}],"videos":[],"update_log":[{"date":"2026-09-18T00:00:00.000Z","note":"Publicación inicial basada en el artículo original de RAG y documentación de AWS y Google Cloud."}],"citation_guidance":{"preferred_url":"https://visteesto.com/nota/que-es-rag-ia-como-funciona","include":["headline","author","date_published_or_modified","preferred_url"]}}