Metodología

Cómo evaluamos la IA clínica

Evaluamos cada herramienta en cinco categorías mediante una rúbrica publicada aplicada a hechos verificados y con fuente sobre la herramienta, no un banco de pruebas oculto. Cada valoración remite a un hecho que puedes comprobar, y publicamos cada cambio.

Qué son estas valoraciones — y qué no son

Cada herramienta se valora de 0 a 10 en cinco categorías. Son valoraciones editoriales derivadas de hechos verificados, no puntuaciones de precisión medida. No ejecutamos un banco de pruebas de precisión propietario, y no publicamos ninguna cifra que no podamos rastrear hasta un hecho documentado y comprobable sobre la herramienta: su precio, disponibilidad, fuentes de contenido, funciones, integraciones y gobernanza.

Cuando existen estudios independientes y publicados sobre la precisión o la seguridad de una herramienta (por ejemplo, comparaciones revisadas por pares, o el estudio de seguridad NOHARM de Stanford/Harvard/ARISE), los citamos y atribuimos; nunca reformulamos una afirmación de precisión del marketing de un proveedor como si fuera una conclusión propia.

La puntuación global es el promedio simple de las cinco categorías. La elección de las categorías y su ponderación equitativa es un juicio editorial, declarado abiertamente aquí para que decidas si estás de acuerdo. Un lector que pondere una categoría más que nosotros puede, con razón, ordenar las herramientas de forma diferente.

Las cinco categorías

01 — Accesibilidad

Quién puede usar realmente la herramienta. Sopesamos el coste (gratuita, freemium, de pago o institucional), el alcance geográfico, las barreras de verificación profesional y si el producto se financia con publicidad. Una herramienta de pago o solo institucional, o limitada a una única región, obtiene una puntuación más baja aquí, por bueno que sea su contenido.

02 — Contenido y evidencia

La sustancia detrás de las respuestas. Sopesamos la amplitud y la curación del corpus subyacente, si las respuestas incluyen citas trazables hasta una fuente primaria y con qué transparencia se gradúa la solidez de la evidencia. Aquí no puntuamos la precisión bruta: eso requeriría un banco de pruebas que no ejecutamos.

03 — Funciones clínicas

La amplitud de funciones de apoyo a la decisión que un clínico puede usar realmente: diagnóstico diferencial, referencia de fármacos e interacciones, orientación sobre tratamiento y manejo, documentación/transcripción y preparación de exámenes. Cuantas más funciones relevantes y verificables, mayor puntuación.

04 — Integración

Hasta qué punto la herramienta encaja en un flujo de trabajo real: integración con la historia clínica electrónica (p. ej. SMART on FHIR), una API para desarrolladores y disponibilidad en web y móvil. Una herramienta capaz pero autónoma obtiene una puntuación más baja aquí que una integrada donde los clínicos ya trabajan.

05 — Confianza y gobernanza

Las salvaguardas en torno a la herramienta: postura ante HIPAA y RGPD, validación independiente, situación regulatoria y conflictos de interés (por ejemplo, un modelo de financiación publicitario o farmacéutico). El reconocimiento independiente de terceros eleva esta puntuación; las afirmaciones del proveedor sin auditar no.

Lo que no hacemos

  • No aceptamos pagos, créditos gratuitos ni acceso beta a cambio de cobertura.
  • No dejamos que los proveedores revisen las valoraciones antes de la publicación.
  • No publicamos una puntuación que no podamos rastrear hasta un hecho documentado, y no presentamos las valoraciones editoriales como resultados de un banco de pruebas medido.
  • No cambiamos las valoraciones retroactivamente sin publicar qué cambió y por qué.

Conflictos y declaraciones

Cuando un miembro del equipo editorial tiene una relación previa con un proveedor que cubrimos, esa relación se declara en nuestra página de divulgaciones y el miembro se inhibe de valorar esa herramienta. Cuando una herramienta se referencia como «principal elección» o «destacada», esa posición debe ser defendible a partir de los hechos publicados y la rúbrica, nunca solo por preferencia editorial.

Actualizaciones y correcciones

Las valoraciones se revisan trimestralmente, y una valoración solo cambia cuando un hecho verificable sobre la herramienta —precio, disponibilidad, funciones, gobernanza— cambia realmente, con el cambio registrado y fechado. Si nos equivocamos en un hecho, publicamos una corrección en la página afectada y actualizamos el registro de nuestra política editorial.