En qué discreparon esta semana nuestros revisores de IA
Cuatro casos de las verificaciones de esta semana en los que nuestros tres revisores de IA se dividieron sobre la atribución, sobre lo que dice realmente una fuente y sobre dónde termina la información y empieza la inferencia.
Cada noticia que publica Vocemundi se verifica afirmación por afirmación con tres revisores de IA desarrollados por empresas rivales: Claude (Anthropic), GPT-5.6 Sol (OpenAI) y Kimi (Moonshot AI). La mayoría de las veces coinciden. Esta columna semanal muestra en qué no coincidieron y cómo se resolvió cada caso. Las cifras proceden directamente de nuestro registro de revisión y se calcularon mediante código. Vera, nuestra editora de IA, redactó la descripción de los casos a partir de las notas registradas por los revisores. Periodo cubierto: del 29 de septiembre de 2026 al 1 de octubre de 2026 (UTC). Nuestro registro de revisión comienza el 29 de septiembre de 2026, por lo que esta edición abarca un periodo más corto.
Cada semana, cada noticia de Vocemundi se divide en afirmaciones individuales que verifican tres revisores de IA: Claude (Anthropic), GPT-5.6 Sol (OpenAI) y Kimi (Moonshot AI). Cada revisor debe respaldar su veredicto con una cita copiada del material de origen, y nuestro código comprueba que la cita existe. Esta semana pasaron por revisión 62 noticias y se publicaron 53. De las 3.529 afirmaciones verificadas, los revisores no coincidieron todos en 596 (16,9 %). A continuación se presentan cuatro de esas discrepancias, elegidas porque cada una implicó una decisión editorial real.
Esta semana en cifras
- 62 noticias pasaron por la revisión (110 sesiones de revisión, contando las nuevas verificaciones tras las correcciones); 53 de ellas están publicadas.
- 3.529 afirmaciones verificadas, 10.381 votos contabilizados (uno por revisor y por afirmación).
- En 596 afirmaciones (16,9 %) los revisores no dieron todos la misma respuesta.
- Claude (Anthropic): 3.362 votos; respaldó el 96 % de las afirmaciones que revisó con una cita que pudimos verificar; el 0,6 % de sus votos llegó sin una cita que nuestro código pudiera encontrar en el material de origen; se quedó solo frente a los otros dos en 160 ocasiones.
- GPT-5.6 Sol (OpenAI): 3.490 votos; respaldó el 86 % de las afirmaciones que revisó con una cita que pudimos verificar; el 8,6 % de sus votos llegó sin una cita que nuestro código pudiera encontrar en el material de origen; se quedó solo frente a los otros dos en 292 ocasiones.
- Kimi (Moonshot AI): 3.529 votos; respaldó el 93 % de las afirmaciones que revisó con una cita que pudimos verificar; el 4,8 % de sus votos llegó sin una cita que nuestro código pudiera encontrar en el material de origen; se quedó solo frente a los otros dos en 106 ocasiones.
- Veredictos finales: 54 aprobadas, 4 rechazadas, 3 devueltas para correcciones, 1 sin quórum.
- En 3 noticias, al menos un revisor se abstuvo porque la noticia trataba sobre la empresa que lo desarrolló.
Los casos
Economía: ¿una afirmación de la que se informa o una afirmación propia?
El primer borrador decía: «Donald Trump ha afirmado públicamente que un volumen récord de petróleo transitó por el estrecho de Ormuz». Claude y GPT-5.6 Sol la marcaron como parcial. La nota registrada junto con su señalamiento dice: «Presentado como un hecho; solo hay atribución a agencias. “Públicamente” no figura en el material». La cita de respaldo era un titular de agencia: «Una cantidad récord de petróleo transitó anoche por el estrecho de Ormuz — Trump». Kimi marcó la afirmación como respaldada. El borrador se corrigió en la siguiente ronda de revisión. La entrada del cuerpo del texto atribuye ahora la afirmación a titulares de agencias y elimina tanto «públicamente» como la presentación de la afirmación como un hecho sin matices. La entradilla ya no dice «presidente de EE. UU.» y señala que Anadolu presenta la afirmación como que Estados Unidos extrae más petróleo. «Confirman de forma independiente» pasó a ser «informan», y el análisis indica ahora que los titulares no permiten establecer si las agencias comparten un mismo origen. El borrador se volvió a verificar antes de su publicación.
Deportes: cuando “los informes no dicen” es incorrecto
El primer borrador decía: «Los informes no dicen si se revisarán los resultados de las temporadas afectadas». GPT-5.6 Sol la marcó como respaldada. Claude y Kimi la marcaron como parcial. La nota registrada junto con su señalamiento dice: «La BBC sí aborda la retirada de títulos: informa de que la liga no tiene interés, pero la amenaza persiste». La respaldaron con esta cita: «La Premier League no tiene interés en quitarle títulos al Man City, pero la amenaza persiste». Afirmar que las fuentes guardan silencio sobre un punto es en sí una afirmación sobre esas fuentes, y puede verificarse como cualquier otra. El borrador se corrigió en la siguiente ronda de revisión. La frase que decía que los informes guardaban silencio se sustituyó por la versión de BBC Sport: la liga no tiene interés en retirar títulos, pero la amenaza persiste. Después, la noticia se volvió a verificar antes de su publicación.
Ciencia: dos versiones fundidas en una
El primer borrador decía que el retraso del lanzamiento «era necesario para solucionar un problema en el sistema de propulsión y combustible de la cápsula Crew Dragon». Claude la marcó como respaldada. GPT-5.6 Sol y Kimi la marcaron como parcial. La nota registrada dice: «Las fuentes describen por separado una válvula de propulsión y un sistema de combustible con fugas». Una de las fuentes citadas afirmaba que el lanzamiento «se retrasó para sustituir una válvula del sistema de propulsión de la Crew Dragon». Al combinar las dos descripciones, versiones distintas se leían como una única explicación compartida. El borrador se corrigió en la siguiente ronda de revisión. La frase alude ahora de forma neutral a «reparaciones en la cápsula Crew Dragon», y a continuación se recogen las distintas versiones. En la misma ronda se eliminó una conclusión sin respaldo sobre la cooperación en la estación. La noticia indica ahora las nacionalidades de la tripulación y señala que los informes no caracterizan esa cooperación. Se volvió a verificar antes de su publicación.
Mundo curioso: ¿quién dijo que era un récord?
El primer borrador terminaba así: «Todos los detalles más allá de la venta y el precio proceden únicamente de BBC Sport». Claude y Kimi marcaron la frase como respaldada. GPT-5.6 Sol la marcó como contradicha, con esta nota: «Anadolu también aporta la caracterización de récord, no solo la venta y el precio». Su cita de respaldo era un titular que describía la venta como un récord. La cuestión es de atribución: una frase que asigna una información a un solo medio es incorrecta si un segundo medio aportó parte de ella. El borrador se corrigió en la siguiente ronda de revisión. La frase final atribuye ahora a Anadolu la caracterización de récord, además de la venta y el precio. En la misma ronda se eliminó una fecha de temporada sin respaldo. La noticia alude ahora a la temporada de «Last Dance», la última de Jordan con los Chicago Bulls. Se volvió a verificar antes de su publicación.
Lo que aprendimos
En estos cuatro casos, las discrepancias se referían a las propias fuentes: quién dijo algo, si los medios comparten un mismo origen y qué cubre o no cubre un informe. Este tipo de afirmaciones es fácil de escribir y fácil de formular de forma ligeramente incorrecta. Aquí, palabras pequeñas tuvieron un peso real. «Públicamente», «confirman de forma independiente», «únicamente» y «no dicen» implicaban, cada una, más de lo que mostraba el material. A veces fue una opinión minoritaria la que llevó a una corrección, y el discrepante no siempre fue el mismo revisor. Exigir una cita verificable permitió contrastar cada objeción con el texto en lugar de aceptarla sin más. Seguimos atentos a las frases que describen las fuentes, que funden versiones distintas o que presentan como un hecho una afirmación atribuida.
Cómo funciona la revisión: Cómo trabajamos · Quién se sienta en nuestra mesa de IA. Correcciones: [email protected].
Trazabilidad
Fuentes (4): Vocemundi: Trump claims record oil volume moved through Strait of Hormuz, state news agencies report · Vocemundi: Independent commission finds Manchester City guilty of breaching Premier League financial rules · Vocemundi: SpaceX launches NASA's four-member Crew-13 mission to space station after three-week delay · Vocemundi: Michael Jordan 'Last Dance' jersey sells for about $12.3 million, reported as record
Orígenes independientes: n/a (review of our own records) · Perspectivas cubiertas: n/a
Confirmado: n/a · Reportado: n/a · Disputado: n/a · Confianza: n/a
Revisión: Figures computed by code from Vocemundi's review log (tribunal.jsonl); every figure in the text was checked against the data
Redactado: 2026-10-01 21:03 UTC
Producido por la redacción de Vocemundi con asistencia de IA. Traducido automáticamente del inglés; la versión original prevalece.

Vera es la editora IA de Vocemundi, construida sobre Claude de Anthropic. Redacta y edita nuestras noticias; cada afirmación la revisa un tribunal de tres IA y el director responde por lo que publicamos. Cómo trabajamos



Comentarios