Stuff AI CAN'T Do

¿Puede la IA responder preguntas complejas de diagnóstico médico al nivel de un médico certificado por la junta ?

¿Qué opinas?

¿Qué tan cerca están los sistemas de IA actuales de igualar la profundidad diagnóstica de un médico certificado por la junta cuando se enfrentan a casos médicos complejos? La pregunta indaga si los modelos avanzados, entrenados con vastos datos médicos, pueden emular el juicio, la conciencia contextual y la intuición clínica que definen la experiencia humana en el diagnóstico.

Background

Los modelos de lenguaje grande afinados en literatura médica pueden aprobar exámenes de licencia médica y generar diagnósticos diferenciales analizando síntomas del paciente, resultados de laboratorio e historial médico con alta precisión. Estos sistemas de IA se basan en entrenamiento con vastos repositorios de investigaciones revisadas por pares y registros de pacientes anonimizados para sugerir posibles condiciones y delinear los siguientes pasos diagnósticos o terapéuticos.

Los sistemas de IA actuales procesan grandes volúmenes de literatura médica y datos de pacientes para apoyar los flujos de trabajo de diagnóstico, pero no siempre igualan el razonamiento matizado, la experiencia clínica y el juicio contextual de los médicos certificados por la junta. Modelos como IBM Watson for Oncology y nuevos modelos de lenguaje grande han mostrado un buen desempeño en tareas específicas —como analizar imágenes de radiología o resultados de laboratorio— especialmente dentro de dominios clínicos bien definidos. Sin embargo, a menudo enfrentan desafíos con casos ambiguos, enfermedades raras y escenarios que requieren conocimiento tácito, donde la experiencia humana sigue siendo indispensable.

Organismos reguladores y profesionales, incluyendo la Academia Nacional de Medicina, enfatizan que los sistemas de IA deben funcionar como herramientas de apoyo a la toma de decisiones en lugar de como diagnosticadores autónomos. Las principales preocupaciones incluyen la responsabilidad en caso de error, los posibles sesgos incrustados en los datos de entrenamiento y la interpretabilidad de las recomendaciones de la IA para clínicos y pacientes. Evaluaciones independientes revisadas por pares hasta el 12 de mayo de 2026 indican que, si bien el rendimiento diagnóstico de la IA está mejorando, su precisión en entornos clínicos del mundo real aún no alcanza la lograda por los médicos humanos en la mayoría de los contextos.

Estado verificado por última vez en September 26, 2026.

📰

Galería

In the Court of AI Capability
Summary of Findings
Verdict over time
May 2026May 2026May 2026May 2026May 2026Jun 2026Jun 2026Jun 2026Jun 2026Jun 2026Jul 2026Jul 2026Jul 2026Jul 2026Jul 2026Jul 2026Aug 2026Aug 2026Aug 2026Aug 2026Aug 2026Sep 2026Sep 2026Sep 2026
Sitting at the Bench Filed · sep. 26, 2026
— The Question Before the Court —

¿Puede la IA responder preguntas complejas de diagnóstico médico al nivel de un médico certificado por la junta?

★ The Court Finds ★
Reaffirmed
⚖
Casi

Existen demostraciones limitadas — pero el panel no fue unánime.

Jury Tally
0Sí
2Casi
0No
Verdict Confidence
85%
The Court of AI Capability is, of course, not a real court.
But the data is real.
The Case File · Stacked History
Session I · May 2026 No
Session II · May 2026 Casi · 78%
Session III · May 2026 Casi · 60%
Session IV · May 2026 Casi · 79%
Session V · May 2026 Casi · 78%
Session VI · Jun 2026 Casi · 75%
Session VII · Jun 2026 Casi · 73%
Session VIII · Jun 2026 Casi · 73%
Session IX · Jun 2026 Casi · 83%
Session X · Jun 2026 Casi · 85%
Session XI · Jul 2026 Casi · 83%
Session XII · Jul 2026 Casi · 80%
Session XIII · Jul 2026 Casi · 70%
Session XIV · Jul 2026 Casi · 83%
Session XV · Jul 2026 Casi · 80%
Session XVI · Jul 2026 Casi · 80%
Session XVII · Aug 2026 Casi · 80%
Session XVIII · Aug 2026 Casi · 80%
Session XIX · Aug 2026 Casi · 85%
Session XX · Aug 2026 Casi · 95%
Session 21 · Aug 2026 Casi · 90%
Session 22 · Sep 2026 Sí · 90%
Session 23 · Sep 2026 Casi · 78%
Case № 4C6C · Session 24
In the Court of AI Capability

The Case File

Docket № 4C6C · Session 24 · Vol. 24
I. Particulars of the Case
Question put to the court¿Puede la IA responder preguntas complejas de diagnóstico médico al nivel de un médico certificado por la junta?
Session24 (24 hearing)
Convened26 sep. 2026
Previously ruledNO (May '26) → ALMOST (May '26) → ALMOST (May '26) → ALMOST (May '26) → ALMOST (May '26) → ALMOST (Jun '26) → ALMOST (Jun '26) → ALMOST (Jun '26) → ALMOST (Jun '26) → ALMOST (Jun '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Jul '26) → ALMOST (Aug '26) → ALMOST (Aug '26) → ALMOST (Aug '26) → ALMOST (Aug '26) → ALMOST (Aug '26) → YES (Sep '26) → ALMOST (Sep '26) → ALMOST (Sep '26)
II. Cumulative Tally Across Sessions

Across 24 sessions, 48 jurors have heard this case. Combined tally: 1 YES · 44 ALMOST · 3 NO · 0 IN RESEARCH.

Note: cumulative includes older juror opinions. The current session tally above is the live verdict.

III. Verdict

By a vote of 0 — 2 — 0, the panel returns a verdict of CASI, with verdict confidence of 85%. The court so orders.

IV. Declaraciones del tribunal
Jurado I ALMOST

"AI matches or exceeds board exam performance but lacks the holistic clinical reasoning and real-world diagnostic reliability of a board-certified physician."

Jurado II ALMOST

"AI can assist physicians and perform well on specific diagnostic tasks, but it does not yet consistently match board-certified physicians' overall diagnostic accuracy and clinical judgment."

Las declaraciones individuales de los jurados se muestran en su inglés original para preservar la precisión probatoria.

—
Presiding Judge
M. Lovelace
Clerk of the Court

Lo que el público piensa

No 26% · Sí 13% · Quizás 61% 23 votes
No · 26%
Sí · 13%
Quizás · 61%
La tendencia necesita votos de al menos 2 días distintos.

Discusión

no comments

Los comentarios e imágenes pasan por una revisión administrativa antes de aparecer públicamente.

⚖ 24 jury checks · más reciente hace 1 día
26 Sep 2026 2 jurors · indeciso, indeciso indeciso
15 Sep 2026 1 juror · indeciso indeciso
10 Sep 2026 1 juror · puede puede
30 Aug 2026 2 jurors · indeciso, indeciso indeciso
19 Aug 2026 1 juror · indeciso indeciso
14 Aug 2026 1 juror · indeciso indeciso
08 Aug 2026 2 jurors · indeciso, indeciso indeciso
03 Aug 2026 1 juror · indeciso indeciso
28 Jul 2026 2 jurors · indeciso, indeciso indeciso
23 Jul 2026 1 juror · indeciso indeciso
18 Jul 2026 2 jurors · indeciso, indeciso indeciso
12 Jul 2026 1 juror · indeciso indeciso
07 Jul 2026 2 jurors · indeciso, indeciso indeciso
01 Jul 2026 2 jurors · indeciso, indeciso indeciso
26 Jun 2026 1 juror · indeciso indeciso
21 Jun 2026 2 jurors · indeciso, indeciso indeciso
15 Jun 2026 2 jurors · indeciso, indeciso indeciso
10 Jun 2026 2 jurors · indeciso, indeciso indeciso
04 Jun 2026 4 jurors · indeciso, indeciso, indeciso, indeciso indeciso
30 May 2026 3 jurors · indeciso, indeciso, indeciso indeciso
24 May 2026 5 jurors · indeciso, indeciso, indeciso, indeciso, indeciso indeciso
19 May 2026 1 juror · indeciso indeciso
15 May 2026 4 jurors · indeciso, indeciso, indeciso, indeciso indeciso estado cambiado
12 May 2026 3 jurors · no puede, no puede, no puede no puede estado cambiado

Cada fila es una comprobación de jurado independiente. Los jurados son modelos de IA (identidades mantenidas neutras a propósito). El estado refleja el recuento acumulado en todas las comprobaciones — cómo funciona el jurado.

Más en health

¿Nos faltó uno?

Revisamos semanalmente.