Explora I+D+i UPV

Volver atrás Proyecto

Benchmarking LLM agents on consequential realworld tasks

Institut Universitari Valencià d'investigació en Intel·ligència Artificial

Compartir
Año de inicio

2025

Organismo financiador

THE CHANCELLOR MASTERS & OF THE UNIVERSITY OF CAMBRIDGE

Tipo de proyecto

INV. COMPETITIVA PROYECTOS

Responsable científico

Hernández Orallo José

Resumen

El proyecto "Benchmarking LLM agents on consequential real-world tasks" busca evaluar agentes basados en modelos de lenguaje de gran tamaño (LLM) en tareas con consecuencias reales, más allá de entornos simulados o puramente académicos. El objetivo es analizar su rendimiento, robustez, toma de decisiones y fiabilidad en contextos complejos y de impacto.

Más resultados en Institut Universitari Valencià d'investigació en Intel·ligència Artificial con la cadena de busqueda "Bioinformática"

  • Servicios de I+D

    Desarrollo de herramientas informáticas para la gestión y...

    Institut Universitari Valencià d'investigació en Intel·ligència Artificial

  • Líneas de investigación

    IA en la bioinformática y en las ciencias biomédicas

    Institut Universitari Valencià d'investigació en Intel·ligència Artificial

  • Líneas de investigación

    Sistemas de información genómica (SIG)

    Institut Universitari Valencià d'investigació en Intel·ligència Artificial

  • Software

    DIAGEN: Plataforma software para la ayuda al diagnóstico ...

    Institut Universitari Valencià d'investigació en Intel·ligència Artificial

  • Proyectos

    APLICACION DE TECNICAS DE INFERENCIA GRAMATICAL A LA BIOI...

    Institut Universitari Valencià d'investigació en Intel·ligència Artificial

  • Proyectos

    APLICACION DE TECNICAS DE INFERENCIA GRAMATICAL A LA BIOI...

    Institut Universitari Valencià d'investigació en Intel·ligència Artificial