Qué medimos (y qué no)
Fluentry mide la alfabetización en IA: su capacidad para reconocer las salidas de una IA, evaluar su calidad y razonar sobre cuándo y cómo conviene usar la IA. En concreto: ¿sabe detectar material generado por IA?, ¿entiende cómo funciona la IA a un nivel que le permita leer las noticias con criterio?, ¿es capaz de razonar sobre situaciones éticas que implican IA?
Qué no mide Fluentry
- Su capacidad para construir IA. No somos un test de programación ni una certificación de ingeniería de aprendizaje automático.
- Su capacidad para usar una herramienta de IA concreta. No certificamos la destreza con ChatGPT, Claude, Copilot ni con ningún otro producto. Las herramientas cambian cada trimestre; la alfabetización perdura.
- Su capacidad para sustituir una tarea humana por IA. No le calificamos en destreza de automatización.
- Su inteligencia, su empleabilidad o su potencial de ingresos futuros. La alfabetización en IA es una competencia entre muchas.
Si necesita una evaluación de alguno de los puntos anteriores, Fluentry no es la herramienta adecuada. Preferimos decírselo antes que sobrevender el test.
Cómo se crean las preguntas
Cada pregunta de un test de Fluentry se escribe de forma conjunta. Una persona docente identificada por su nombre encarga la pregunta. Donde ayuda a la calidad y a la rapidez, las herramientas de IA redactan material. Dos personas revisan cada pregunta antes de su publicación. Cuando la respuesta depende del criterio, en nuestros escenarios de ética, un panel de expertos acreditados fija los valores puntuados. La IA nunca fija un valor puntuado.
Divulgamos el papel de la IA a nivel de tipo de pregunta. No lo ocultamos ni lo exageramos. El proceso reside en nuestro repositorio de contenidos (content repository), disponible bajo acuerdo de confidencialidad (NDA) para la evaluación de compras.
Qué hace la IA, por test
Can AI Fool You? El lado humano lo redacta una persona colaboradora identificada por su nombre, sin emplear ninguna herramienta de IA para su redacción o edición. El lado de la IA se genera mediante una rotación de cinco o más modelos de vanguardia. Una segunda persona identificada por su nombre revisa ambos lados antes de fusionarlos.
AI Knowledge: el enunciado y la elección del concepto los redactan autores internos o personas expertas en la materia contratadas. La IA puede sugerir las opciones incorrectas, las etiquetas de concepto y las explicaciones; la persona autora humana selecciona, edita y aprueba. La IA nunca redacta el enunciado ni elige la respuesta correcta.
AI Ethics: los enunciados y la redacción de las opciones los escriben personas. La IA puede sugerir variantes, pero la versión final siempre la escribe la persona autora humana. El valor puntuado de cada opción lo fija un panel de expertos de al menos dos profesionales. La IA nunca fija un valor puntuado.
Qué no hace nunca la IA
- La IA nunca fija un valor puntuado en una pregunta de tipo Escenario.
- La IA nunca elige la respuesta correcta en una pregunta Knowledge.
- La IA nunca redacta un lado humano en un test por pares.
- La IA nunca revisa ni aprueba una pregunta. Ambas revisiones son humanas.
- La IA no se utiliza para generar imágenes de personas reales o identificadas, ni para imitar el estilo de un fotógrafo concreto.
- La IA no se utiliza para generar fotografías de los autores, revisores, clientes ni del equipo de Fluentry.
De dónde proceden las fotografías humanas
El lado humano de nuestros pares de imágenes utiliza fotografías reales tomadas por fotógrafos en activo. Incluyen imágenes de Martin Vorel, publicadas a través de su proyecto de fotografía libre LibreShot. Acreditamos a los fotógrafos aquí y no en la superficie del test, porque indicar la fuente junto a un par en vivo daría una pista sobre la respuesta.
Cómo puntuamos cada test
Su puntuación es el porcentaje de preguntas que respondió correctamente, con algo más de crédito para las preguntas difíciles y algo menos para las fáciles, en una escala de 0 a 100.
En nuestro test de ética la lógica cambia: su puntuación de ética es el valor medio de las opciones que eligió, en una escala de 0 a 100. Las opciones de mayor valor reflejan las posturas éticas más sólidas que nuestro panel de expertos clasificó.
En la mayoría de las preguntas de tipo Escenario no hay una única respuesta correcta. La escala de valores refleja el juicio experto del panel, no una verdad objetiva. Más abajo en esta página explicamos quién forma parte del panel.
Qué significa un Grade
Fluentry utiliza una escala de Grades inspirada en los Grades de los exámenes de música: del Grade 1 al Grade 8, con un nivel Diploma por encima del Grade 8.
Su Grade se calcula a partir de las puntuaciones que ha obtenido en cada test. Usamos su puntuación más reciente en cada test (no la mejor), ponderada hacia el rendimiento reciente, de modo que un Grade que obtuvo hace un año no eclipse el test que hizo la semana pasada.
Los umbrales de Grade están anclados a miles de sesiones de Fluentry. No se mueven. Un Grade 5 en 2027 significa la misma competencia que un Grade 5 en 2026, la misma propiedad que hace que el certificado de un violinista de Grade 5 sea significativo a lo largo de las décadas.
Qué hay detrás de cada Grade
| Grade | Representa | Qué significa |
|---|---|---|
| Diploma | Top 2 % | El nivel de élite. Rendimiento distintivo en todo el banco. |
| Grade 8 | Top 6 % | Distinguido. |
| Grade 7 | Top 15 % | Sólido, con alcance. |
| Grade 6 | Top 25 % | Sólido. |
| Grade 5 | Top 40 % | Consistente. |
| Grade 4 | Top 55 % | Capaz. |
| Grade 3 | Top 70 % | En desarrollo. |
| Grade 2 | Top 85 % | Fundamental. |
| Grade 1 | Por debajo del Grade 2 | Principiante. El primer peldaño. |
Estas son las bandas de percentiles en el momento de la instantánea de calibración del lanzamiento. Después se convierten en cortes de puntuación fijos y se congelan; no se desplazan a medida que llegan nuevos participantes. Un Grade obtenido en 2027 refleja la misma competencia que uno obtenido en 2026.
Por qué anclado y no móvil
Los umbrales móviles, en los que el corte del Grade 5 se desplaza cada mes a medida que llegan nuevos participantes, producen inflación o deflación de calificaciones según hacia dónde se desplace la población. Los umbrales anclados producen una credencial estable. Elegimos la credencial. Cuando cambiamos sustancialmente nuestra metodología, por ejemplo al añadir un nuevo tipo de test que afecta a cómo se agregan los Grades, reanclamos de forma explícita y notificamos a cada usuario cuyo Grade cambie. Es la misma disciplina que los tribunales de exámenes de música han aplicado durante décadas.
El nivel Diploma
El Diploma es el 2 % superior de todos los Grades de Fluentry. No es un Grade 9; es un nivel aparte con su propio tratamiento de credencial. Elegimos el 2 % porque es lo bastante raro como para resultar significativo y no tan raro como para desaparecer en un año de lanzamiento cualquiera.
Orientación futura: cuando se lance nuestra Academy, el nivel Diploma podría evolucionar para exigir la finalización de un curso además del umbral de puntuación. Anunciaremos ese cambio con antelación y actualizaremos esta página el mismo día en que se publique.
Cuando se lanza un nuevo test
Quien solo ha hecho un test de Fluentry tiene un Grade basado en ese test. Cuando se lanza un nuevo test, su Grade no cambia de la noche a la mañana; conserva lo que obtuvo. Sube (o se mantiene, o baja) al hacer más tests. Nunca forzamos una repetición.
Cómo le comparamos
Comparar su puntuación con la de otros participantes de su país solo funciona cuando un número suficiente de ellos lo ha realizado. Si su país aún es pequeño, se lo decimos. Su tarjeta para compartir siempre muestra un percentil, nunca le dejaremos sin una cifra, pero divulgamos de dónde la obtuvimos: su país, el conjunto europeo más amplio o (mientras las cifras mundiales aún se están formando) el conjunto global.
La imagen para compartir que genera se congela en el momento de compartirla. Si su país gana más participantes el mes que viene y su percentil local cambia ligeramente, la imagen que publicó en LinkedIn no cambia de forma retroactiva.
Con quién se le compara
| Cuándo | Fuente | Qué ve |
|---|---|---|
| Su país tiene suficientes participantes | Su país | Mejor que el X % de los participantes de {country} |
| Su país aún es pequeño, pero Europa es grande | Conjunto europeo | Mejor que el X % de los participantes europeos |
| Ambos siguen siendo pequeños | Conjunto europeo (por tramos) | Top X % de los participantes europeos hasta ahora |
| Las cifras mundiales aún se están formando | Global (por tramos) | Está entre los primeros en realizar este test; la comparación todavía se está formando |
Una salvedad honesta
Cuando combinamos las puntuaciones europeas entre países, el resultado es una aproximación. Los bancos de preguntas difieren: las preguntas de test por pares en francés no son traducciones de las inglesas; se redactan de forma independiente conforme a una rúbrica de dificultad compartida. La cifra europea combinada es, por tanto, un agregado de tests de dificultad comparable pero no idéntica. A medida que las cifras propias de cada país superan sus primeros cientos de participantes, volvemos al conjunto propio de su país, que es la comparación más limpia.
Salud de las preguntas
Las preguntas de Fluentry se evalúan de forma continua frente a las personas que las responden. Cada semana, cada pregunta activa se califica por acierto y participación. Las preguntas que se vuelven demasiado fáciles, demasiado difíciles o que muestran un salto repentino en el acierto (señal de que la respuesta se ha filtrado) se marcan. Las preguntas que de forma constante no logran discriminar se retiran del banco activo.
Las cifras agregadas de salud de las preguntas del banco activo están disponibles bajo acuerdo de confidencialidad (NDA) para la evaluación de compras.
Cuando una pregunta deja de funcionar, porque se vuelve demasiado fácil al mejorar la IA, porque aparece en un foro público o porque sencillamente ya no revela nada útil, se retira. La reemplazamos. El banco activo de preguntas se renueva de forma continua. Registramos cada retirada y reportamos los recuentos agregados bajo acuerdo de confidencialidad (NDA) para la evaluación de compras.
Agregamos estos datos por test y por tipo de test, nunca por pregunta (la identidad de una pregunta es propiedad intelectual que no divulgamos).
Quién construye el banco
El banco de preguntas de Fluentry lo construye un equipo que combina redacción interna, experiencia contratada de especialistas en la materia y una red de docentes, personas expertas en ética y profesionales de políticas públicas. Cada pregunta la revisa una segunda persona antes de su publicación. En los escenarios de ética, los valores puntuados los fija un panel de expertos de al menos dos profesionales.
No publicamos nombres individuales en el sitio público; la mayoría de las personas colaboradoras se contratan por pregunta, y esa es su preferencia habitual. Sí divulgamos el estándar con el que contratamos. Para la evaluación de compras, facilitamos la lista completa de autores y revisores bajo acuerdo de confidencialidad (NDA).
El estándar con el que contratamos
- Autores: redactores internos con conocimiento práctico de la materia, o personas expertas contratadas con experiencia publicada o en ejercicio en el dominio del test. Los lados humanos de los tests por pares los escriben hablantes nativos de la lengua del test.
- Revisores: una segunda persona, independiente del autor, hablante nativa de la lengua del test, con conocimiento práctico suficiente del dominio para valorar el acierto y la pertinencia.
- Panel de expertos (Ética): al menos dos panelistas por pregunta con experiencia en ejercicio o publicada en ética de la IA, política de la IA, filosofía o campos afines. La mediana del panel fija el valor puntuado.
No nombramos públicamente a personas en la v1 porque la mayoría de las personas colaboradoras lo prefieren, porque quienes realizan la evaluación de compras obtienen más valor verificando la lista bajo acuerdo de confidencialidad (NDA) y porque no publicamos datos personales que no necesitamos.
Registro de cambios
Cuando cambia la forma en que Fluentry mide, lo registramos aquí. Se registran tres tipos de cambios. Cambios en las preguntas: las preguntas se retiran de forma continua a medida que el banco evoluciona; registramos las renovaciones por lotes trimestrales, no cada retirada individual. Cambios de metodología: cuando añadimos un nuevo tipo de test, cambiamos cómo se agregan los Grades o revisamos los umbrales de percentil, esta página recibe una entrada versionada, y toda persona cuyo Grade se vea afectado recibe un correo antes de que el cambio se aplique. Cambios de página: cuando esta página se revisa de forma significativa, la entrada de abajo registra qué cambió y cuándo.
| Fecha | Alcance | Resumen |
|---|---|---|
| 3 de junio de 2026 | Página | Revisiones editoriales para mayor claridad en varias secciones. Sin cambios en la metodología, la puntuación ni los umbrales de Grade. |
| Lanzamiento v1 | Página | Página de metodología publicada por primera vez con tres tests en directo (Can AI Fool You?, AI Knowledge, AI Ethics) en en-GB. |
Posición ante el Reglamento de IA de la UE
El Reglamento de IA de la UE (EU AI Act) entró en vigor en febrero de 2025. Dos de sus partes son directamente relevantes para Fluentry.
El artículo 4, la obligación de alfabetización en IA. Las organizaciones que utilizan sistemas de IA deben garantizar que su personal cuente con una alfabetización en IA suficiente. Fluentry existe, en parte, para hacer que esa obligación sea medible. Nuestra oferta B2B documenta la alfabetización en IA de la organización en una forma adecuada para compras y auditoría.
Clasificación de alto riesgo (anexo III). El Reglamento enumera categorías de sistemas de IA que se consideran de alto riesgo y que activan obligaciones de cumplimiento más exigentes. Fluentry no es de alto riesgo conforme al anexo III. Somos una evaluación de alfabetización en IA que utilizan las personas sobre sí mismas y las organizaciones sobre su propio personal con fines de cumplimiento. No se nos utiliza para decisiones de contratación, calificación crediticia, identificación biométrica, calificación educativa en el sentido regulado escolar o universitario, ni para ninguna otra categoría del anexo III.
Para que quede claro: un Grade de Fluentry no es un certificado educativo regulado. Es una credencial que emitimos conforme a nuestra propia metodología, inspirada en los Grades de los exámenes de música, pero que no forma parte de ningún sistema educativo nacional, organismo certificador ni marco de cualificaciones acreditado. Pertenece a la misma categoría conceptual que una racha en una aplicación de idiomas o una insignia de velocidad de mecanografía: una señal real de una competencia real, emitida por la plataforma que la mide, no un título académico reconocido por el Estado.
Cuando un cliente B2B opta por usar Fluentry de una manera que sí activa obligaciones del anexo III, por ejemplo tratando nuestra evaluación como un criterio vinculante en una decisión de contratación, ese uso es responsabilidad del cliente conforme al Reglamento, no de Fluentry. Nuestros contratos B2B estándar asignan esas obligaciones mediante el acuerdo de tratamiento de datos (DPA).
Una nota interna de cumplimiento con el análisis completo del anexo III está a disposición de los equipos de compras bajo acuerdo de confidencialidad (NDA).
ACADEMY METHODOLOGY
How the Academy works
The Academy teaches to the gaps our tests measure, against recognised public frameworks, with every course expert-reviewed and dated. This page explains how it is built and why you can trust it.
What AI literacy means here
We use one model across the Tests and the Academy, so what you are measured on is what you are taught.
AI literacy is more than knowing what a model is. We assess and teach across four pillars: Knowledge (what AI is and how it works), Use (getting useful, safe results from it), Critical (judging output, spotting failure and bias) and Ethics (the responsible and lawful choices around its use).
The Academy is the remediation layer on top of the Tests. The test shows where you are weak, the Academy teaches to that gap and a re-take proves the gain on the same scale.
The frameworks we build against
Every course and role path maps to recognised public frameworks. This is the procurement-grade answer to the question a buyer or regulator asks first: what standard is this against. The frameworks are public, so the mapping is free credibility rather than a private claim.
| Our coverage | Mapped frameworks |
|---|---|
| All-staff foundations | EU Commission Article 4 guidance; DigComp 3.0 (AI dimension); UNESCO AI competency frameworks |
| Use and prompting | DigComp 3.0; EC-OECD AILit framework |
| Critical evaluation and risk | EC-OECD AILit framework; UNESCO AI competency frameworks |
| Ethics, oversight and the law | EU Commission Article 4 guidance; UNESCO Recommendation on the Ethics of AI |
| Manager and oversight role path | EU Commission Article 4 guidance; EC-OECD AILit framework |
Frameworks evolve. We review the mapping each quarter and date the page so you can see when it was last checked.
How a course is made
Courses are drafted with AI from real data on what learners get wrong, then a named expert reviews and signs off, then the course is translated and checked, then it is reviewed and dated every quarter. We disclose AI co-authoring openly, the same stance we take on the Tests, because transparency is a trust asset with EU buyers rather than a liability.
- AI drafts from the gap data: the item-level signal of what people actually get wrong.
- A named subject expert reviews, corrects and signs off before anything goes live.
- Translation and a native-language check across our launch locales.
- A dated quarterly review, with a per-course changelog.
How we measure learning
Every module ends in an assessment built on the same engine as the Tests. We record competence, not just completion, which is the evidence advantage over tick-box training. Completing a course is not the credential; demonstrating the competence is.
Learning feeds the credential. After working a path you re-take the relevant test, your score recomputes your overall Grade and the Grade is the thing that climbs. The credential stays earned, not farmed.
Our EU AI Act position
The Academy is a training product. Its AI features (the practice sandbox and the explain-why tutor) are educational tools, not consequential automated decisions about a person. Our preliminary assessment is that the Academy is not a high-risk AI system, and AI use is clearly disclosed throughout.
This is our preliminary position. The definitive statement publishes here once external counsel has confirmed it.
The evidence and the credential
For an organisation, the Academy produces an EU AI Act Article 4 evidence record: a dated, per-person, per-course log of training and competence, with the leaver records retained, that you can show a regulator. It records competence, not just attendance.
The credential itself is the Grade, not a wallet of course badges. It is one living credential that you come back to improve and that gently decays if you stop, so it reflects current competence. That is the difference between measured fluency and a certificate of attendance.
LAST REVIEWED 6 de junio de 2026
