Gemini, la plataforma de inteligencia artificial de Google DeepMind, ha lanzado Gemini Deep Research y DeepSearchQA, sus nuevos agentes de IA diseñados para llevar a cabo tareas complejas de búsqueda y análisis de información, minimizando las alucinaciones. Ambos agentes operan con el modelo Gemini 3 Pro, optimizados para mejorar la calidad de los informes y reducir errores durante tareas complejas.
Gemini Deep Research se centra en la recopilación y síntesis de información, permitiendo a los desarrolladores integrar la investigación autónoma en sus aplicaciones a través de una nueva API de Interacciones. Por su parte, DeepSearchQA establece un nuevo estándar para evaluar agentes en tareas de búsqueda web que requieren múltiples pasos, mejorando tanto la precisión como la exhaustividad de los resultados obtenidos.
Investigaciones precisas con Gemini Deep Research
Gemini Deep Research ha sido mejorado para abordar tareas de investigación más complejas que requieren un análisis exhaustivo y la recopilación de datos de diversas fuentes. Este agente realiza búsquedas web con mayor precisión y genera informes detallados, planificando su investigación de manera iterativa: formula consultas, revisa resultados, identifica lagunas de conocimiento y lleva a cabo nuevas búsquedas.
Gracias a la integración del modelo Gemini 3 Pro, que lidera en casi todas las categorías de LMArena, se ha mejorado la capacidad de síntesis y se han reducido las alucinaciones. Su principal ventaja es la capacidad de manejar contextos largos y complejos, lo que permite a los desarrolladores incorporar información extensa en las respuestas generadas. Con la nueva API de “Interacciones”, los desarrolladores pueden implementar estas funciones en sus propias aplicaciones, facilitando la creación de herramientas avanzadas para la investigación.
“Deep Research es ahora más útil e inteligente que nunca, y pronto estará disponible en Google Search, NotebookLM, Google Finance y se actualizará en la app de Gemini”, afirmó la empresa.
DeepSearchQA: un nuevo estándar para la investigación web
DeepSearchQA introduce un nuevo benchmark que establece un punto de referencia para evaluar la precisión de los agentes en tareas de búsqueda web que requieren razonamiento en múltiples pasos. A diferencia de las pruebas tradicionales que solo miden la exactitud factual, DeepSearchQA evalúa la exhaustividad, permitiendo a los agentes generar respuestas más completas y detalladas.
Este benchmark incluye 900 tareas de “cadena causal” diseñadas específicamente en 17 campos, donde cada paso depende de un análisis previo. A diferencia de las pruebas convencionales basadas en hechos, DeepSearchQA exige que los agentes produzcan conjuntos de respuestas detalladas, evaluando así tanto la precisión de la investigación como la recuperación de datos.
Además, este agente actúa como herramienta diagnóstica para aprovechar el tiempo de reflexión. “En nuestras evaluaciones internas, hemos observado mejoras significativas en el rendimiento al permitir que el agente realice más búsquedas y pasos de razonamiento, algo que planeamos explorar en futuras versiones”, explican desde Google.
Aplicaciones en el mundo real
Los agentes Gemini Deep Research y DeepSearchQA ya están demostrando resultados destacados en diversos sectores, incluidos los servicios financieros, la biotecnología y la investigación de mercados. En el ámbito financiero, estos agentes se utilizan para automatizar las etapas iniciales de la diligencia debida, reduciendo el tiempo necesario para realizar investigaciones y mejorando así la toma de decisiones.
En el campo de la biotecnología, Gemini Deep Research ha demostrado ser útil en la investigación biomédica, acelerando el proceso de descubrimiento de fármacos al recopilar y analizar datos con una precisión superior a los métodos tradicionales.
