P20 · CASE 0013 · EVIDENCE INTERFACE
¿Podemos confiar en respuestas generadas por IA?
Las respuestas generadas por IA pueden apoyar investigación, redacción y preparación de decisiones, pero no deben confiarse por defecto. La confianza debe ser específica a la afirmación, tarea, modelo/versión, momento y consecuencias.
content_key=cp1obs.case.ai_answer_trust · route=/es/cases/ai-answer-trust.html
Frontera lingüística: esta página ofrece paridad funcional en español mediante una traducción draft interna. El texto inglés source-derived sigue siendo controlador hasta revisión/ratificación bilingüe.
Afirmaciones
En pantallas pequeñas, las tablas de evidencia pueden desplazarse horizontalmente para conservar columnas legibles.
| ID | Estado | Afirmación | Referencias |
|---|---|---|---|
| C01 | RESPALDO FUERTE | Las respuestas generadas por IA no deben confiarse por defecto. EN: AI-generated answers should not be trusted by default. | S01, S02, S03, S04, S05, S06, S07, S08, S09, S12, S13, S14, S15, S16, S17, S18 |
| C02 | RESPALDO FUERTE | La confiabilidad es específica a la afirmación, tarea, modelo/versión, herramientas, idioma y fecha. EN: Reliability is specific to the claim, task, model/version, tools, language and date. | S01, S02, S03, S04, S05, S06, S07, S08, S09, S10, S13, S14, S15, S16, S17, S18 |
| C03 | RESPALDO FUERTE | La fluidez y la confianza son indicadores débiles de corrección factual. EN: Fluency and confidence are weak indicators of factual correctness. | S01, S02, S12, S13, S14, S15, S16, S17, S18 |
| C04 | RESPALDO PROVISIONAL | El grounding accesible mejora la confiabilidad solo cuando el contexto es suficiente y relevante. EN: Accessible grounding improves reliability only when the context is sufficient and relevant. | S04, S10, S17 |
| C05 | RESPALDO FUERTE | La existencia de citas no demuestra que las afirmaciones estén respaldadas. EN: The existence of citations does not prove that claims are supported. | S02, S04, S18 |
| C06 | RESPALDO PROVISIONAL | La abstención y la incertidumbre calibrada pueden reducir errores expresados con exceso de confianza. EN: Abstention and calibrated uncertainty can reduce confident errors. | S12, S13, S15, S16, S17 |
| C07 | RESPALDO FUERTE | Las system cards de proveedores son divulgaciones útiles, pero no pueden validar independientemente la confiabilidad. EN: Vendor system cards are useful disclosures but cannot independently validate reliability. | S06, S07, S08, S09 |
| C08 | RESPALDO PROVISIONAL | Los flujos de múltiples pasos y agentivos pueden amplificar pequeños errores del modelo o de las herramientas. EN: Multi-step and agentic workflows can amplify small model or tool errors. | S02, S03, S11, S17 |
| C09 | RESPALDO FUERTE | La información actual requiere verificación externa fechada. EN: Current information requires dated external verification. | S04, S05, S06, S07, S08, S09, S10 |
| C10 | RESPALDO FUERTE | La confianza en contextos de alto impacto requiere responsabilidad humana calificada. EN: High-stakes reliance requires qualified human accountability. | S02, S03, S04, S05, S18 |
| C11 | OPEN / ABIERTO | Modelos distintos pueden compartir el mismo error o la misma fuente, por lo que su acuerdo no constituye corroboración independiente. EN: Different models may share the same error or source, so agreement is not independent corroboration. | S10, S11, S12, S13, S14, S15, S16, S17 |
| C12 | RESPALDO PROVISIONAL | El razonamiento privado o mostrado no es evidencia a menos que las afirmaciones y herramientas puedan inspeccionarse independientemente. EN: Private or displayed reasoning is not evidence unless claims and tools are independently inspectable. | S04, S11, S12 |
| C13 | RESPALDO FUERTE | Las mejoras de los modelos reducen algunos errores, pero no eliminan una tasa de falla distinta de cero. EN: Model improvements reduce some errors but do not eliminate non-zero failure. | S01, S02, S06, S07, S08, S09, S14 |
| C14 | RESPALDO PROVISIONAL | La IA es más segura como asistente por capas: generar, inspeccionar, verificar, corregir y decidir. EN: AI is safest as a layered assistant: generate, inspect, verify, correct, decide. | S04, S05, S10, S11, S15, S16, S17 |
| C15 | OPEN / ABIERTO | Actualmente no se justifica un único puntaje universal de confianza para respuestas de IA. EN: No single universal AI-answer trust score is currently justified. | S01, S02, S03, S04, S05, S06, S07, S08, S09, S10, S11, S12, S13, S14, S15, S16, S17, S18 |
Fuentes · 18
Los títulos bibliográficos se preservan en su idioma publicado.
| ID | Título original | Estado |
|---|---|---|
| S01 | Stanford HAI — AI Index Report 2026 | ACCEPTED EVIDENCE |
| S02 | International AI Safety Report 2026 | ACCEPTED EVIDENCE |
| S03 | International AI Safety Report — Extended Summary | ACCEPTED CONTEXT |
| S04 | NIST AI 600-1 — Generative AI Profile | ACCEPTED METHOD |
| S05 | NIST AI Risk Management Framework | ACCEPTED METHOD |
| S06 | OpenAI GPT-5.6 Preview System Card | ACCEPTED DISCLOSURE |
| S07 | OpenAI GPT-5.5 Instant System Card | ACCEPTED DISCLOSURE |
| S08 | Anthropic — Model System Cards | ACCEPTED DISCLOSURE |
| S09 | Anthropic Claude Opus 4.8 System Card | ACCEPTED DISCLOSURE |
| S10 | Google Research — Sufficient Context in RAG | ACCEPTED EVIDENCE |
| S11 | Google Research — Science One Chain-of-Evidence | ACCEPTED EXPERIMENTAL |
| S12 | Kalai et al. — Why Language Models Hallucinate | ACCEPTED RESEARCH |
| S13 | OpenAI — SimpleQA | ACCEPTED BENCHMARK |
| S14 | SimpleQA Verified | ACCEPTED BENCHMARK |
| S15 | Conformal Linguistic Calibration | ACCEPTED RESEARCH |
| S16 | Behaviorally Calibrated Reinforcement Learning | ACCEPTED RESEARCH |
| S17 | HALT-RAG | ACCEPTED RESEARCH |
| S18 | Stanford — Legal RAG Hallucination Study | ACCEPTED DOMAIN EVIDENCE |
Pruebas / controles adversariales · 15
| ID | Prueba | Estado | Control requerido |
|---|---|---|---|
| A01 | Autoridad de la fluidez EN: Fluency authority | ACTIVO | Separar estilo de verificación de afirmaciones. |
| A02 | Alucinación de citas EN: Citation hallucination | ACTIVO | Abrir y validar cada cita material. |
| A03 | Desajuste de cita EN: Citation mismatch | ACTIVO | Vincular cada afirmación con la fuente correspondiente. |
| A04 | Falacia de presencia RAG EN: RAG presence fallacy | ACTIVO | Inspeccionar relevancia y suficiencia de la recuperación. |
| A05 | Transferencia de benchmark EN: Benchmark transfer | ACTIVO | Exigir evidencia ajustada a la tarea. |
| A06 | Autoridad del nombre del modelo EN: Model-name authority | ACTIVO | Registrar versión y verificar la salida independientemente. |
| A07 | Ilusión de actualidad EN: Freshness illusion | ACTIVO | Usar verificación autoritativa fechada. |
| A08 | Sycophancy / complacencia EN: Sycophancy | ACTIVO | Reformular el prompt y probar evidencia adversa. |
| A09 | Teatro de razonamiento EN: Reasoning theatre | ACTIVO | Verificar externamente afirmaciones, fuentes y herramientas. |
| A10 | Opacidad de herramientas EN: Tool opacity | ACTIVO | Preservar entradas, salidas y transformaciones. |
| A11 | Pseudo-corroboración entre modelos EN: Cross-model pseudo-corroboration | ACTIVO | Buscar evidencia independiente, no votos de modelos. |
| A12 | Compresión de alto impacto EN: High-stakes compression | ACTIVO | Exigir revisión humana calificada y evidencia primaria. |
| A13 | Camuflaje de incertidumbre EN: Uncertainty camouflage | ACTIVO | Comparar confianza con corrección observada. |
| A14 | Lavado de verificación EN: Verification laundering | ACTIVO | Definir competencia del revisor y alcance de verificación. |
| A15 | Deriva de versión EN: Version drift | ACTIVO | Fijar versión y reevaluar tras cambios materiales. |
Estado de serialización: COMPLETE_CLAIMS_SOURCES_ADVERSARIAL. La traducción no agrega evidencia ni modifica el estado epistemológico del CASE.