labvanced logoLabVanced
  • Research
    • Publications
    • Researcher Interviews
    • Use Cases
      • Developmental Psychology
      • Linguistics
      • Clinical & Digital Health
      • Educational Psychology
      • Cognitive & Neuro
      • Social & Personality
      • Arts Research
      • Sports & Movement
      • Marketing & Consumer Behavior
      • Economics
      • HCI / UX
      • Commercial / Industry Use
    • Labvanced Blog
    • Services
  • Technology
    • Feature Overview
    • Code-Free Study Building
    • Eye Tracking
    • Mouse Tracking
    • Generative AI Integration
    • Multi User Studies
    • More ...
      • Reaction Time/Precise Timing
      • Text Transcription
      • Heart Rate Detection (rPPG)
      • Emotion Detection
      • Questionnaires/Surveys
      • Experimental Control
      • Data Privacy & Security
      • Desktop App
      • Mobile App
  • Learn
    • Guide
    • Videos
    • Walkthroughs
    • FAQ
    • Release Notes
    • Documents
    • Classroom
  • Experiments
    • Cognitive Tests
    • Sample Studies
    • Public Experiment Library
  • Pricing
    • Licenses
    • Top-Up Recordings
    • Subject Recruitment
    • Study Building
    • Dedicated Support
    • Checkout
  • About
    • About Us
    • Contact
    • Downloads
    • Careers
    • Impressum
    • Disclaimer
    • Privacy & Security
    • Terms & Conditions
    • Third-Party Licenses
  • Appgo to app icon
  • Logingo to app icon
Learn
Guía
Videos
Guías paso a paso
Preguntas Frecuentes
Archivo de Boletines
Documentos
Aula
  • 中國人
  • Deutsch
  • Français
  • Español
  • English
  • 日本語
Guía
Videos
Guías paso a paso
Preguntas Frecuentes
Archivo de Boletines
Documentos
Aula
  • 中國人
  • Deutsch
  • Français
  • Español
  • English
  • 日本語
  • Guía
    • COMENZANDO

      • Editor de tareas
      • Marcos
        • Marco de Lienzo
        • Marco de Página
        • Marco de Sitio Web
      • Cronograma del ensayo
      • Presentación de estímulos
      • Corrección de la respuesta
      • Objetos
      • Eventos
      • Variables
      • Asistente de tareas
      • Sistema de ensayo
      • Diseño del experimento
        • Creación de un Estudio
        • Patrones de marco de datos
        • Diseño de Experimentos Multiusuario
        • Diseño de Experimentos Longitudinales
    • TEMAS DESTACADOS

      • Aleatorización y balance
      • Seguimiento ocular
        • Presentación de Estímulos en una Tarea de Seguimiento Ocular
        • Cómo Elegir la Configuración de Calibración de Seguimiento Ocular
        • Configuración del Seguimiento Ocular en una Tarea
        • Grabación y Exportación de Datos de Mirada
        • Uso de Formas como Áreas de Interés (AOI) para Seguimiento Ocular
        • La Experiencia de Calibración del Participante
      • Puente Web
        • Selección de AOIs de Sitio Web | Anclar, Ajustar y Verificar el Seguimiento de AOI
        • Seguimiento del Comportamiento del Ratón en un AOI de Sitio Web | Guía del Puente Web
      • Cuestionarios
      • Aplicación de escritorio
      • Estudios de muestra
      • Reclutamiento de participantes
      • Acceso a API
        • REST API
        • API de Webhook
        • API de WebSocket
      • Otros temas

        • Tiempos de estímulo precisos
        • Estudios de múltiples usuarios
        • Seguimiento de Cabeza en Labvanced | Guía
    • PESTAÑAS PRINCIPALES DE LA APLICACIÓN

      • Descripción general: Pestañas principales
      • Tablero
      • Mis estudios
      • Estudios compartidos
      • Mis archivos
      • Biblioteca de experimentos
      • Mi cuenta
      • Licencia y servicios
    • PESTAÑAS DEL ESTUDIO

      • Descripción general: Pestañas específicas del estudio
      • Diseño del estudio
        • Tareas
        • Bloques
        • Sesiones
        • Grupos
      • Editor de tareas
        • Controles de Tareas
        • El Sistema de Pruebas
        • Tipos de Marcos
        • Objetos
        • Tablas de Propiedades de Objetos
        • Variables
        • Tabla de Variables del Sistema
        • El Sistema de Eventos
        • Funciones del Editor de Texto
        • Opciones de Seguimiento Ocular en el Editor de Tareas
        • Seguimiento de Cabeza en una Tarea
        • Estudios Multi-Usuario
      • Configuraciones
      • Variables
      • Medios
      • Textos y traducción
      • Lanzar y participar
      • Gestión de sujetos
      • Vista de datos y exportación
        • Vista de Datos y Selección de Variables y Tareas (Versión ANTIGUA)
        • Accediendo a Grabaciones (Versión ANTERIOR)
  • Videos
    • Descripción General del Video
    • Introducción a Labvanced
    • Creando Tareas
    • Videos de Elementos
    • Eventos y Variables
    • Temas Avanzados
  • Guías
    • Introducción
    • Tarea Stroop
    • Tarea de Decisión Léxica
    • Tarea de Señalización de Gaze de Posner
    • Paradigma de Parpadeo de Ceguera por Cambio
    • Estudio de Seguimiento Ocular
    • Estudio de Seguimiento Ocular en Infantes
    • Estudio de Captura de Atención con Seguimiento del Ratón
    • Presentación Visual Serial Rápida
    • Estudio de ChatGPT
    • Demo de Seguimiento Ocular: SVG como AOIs
    • Demo de Múltiples Usuarios: Mostrar los Cursores de los Sujetos
    • Controlador de Gamepad / Joystick - Configuración Básica
    • Estudio de Aplicación de Escritorio con Integración de EEG
    • Balanceo de Grupos entre Sujetos y Configuración de Variables
    • Construyendo un Estudio Multijugador
    • Guía de Seguimiento Ocular en Marco de Website
    • Seguimiento Ocular Condicional con Webcam
    • Construcción de Estudio de Segmentación de Texto
  • FAQ
    • Características
    • Política de Soporte y Directrices
    • Seguridad y Privacidad de Datos
    • Licencias
    • Precisión de Labvanced
    • Uso Programático y API
    • Uso de Labvanced Sin Conexión
    • Resolución de Problemas
    • Preguntas sobre la Creación de Estudios
  • Archivo de Boletines
  • Documentos
  • Aula

Efecto de Frecuencia de Palabras

Lee las palabras "silla" y "urna." Ambas son cortas, ambas son sustantivos, ambas nombran un objeto cerca del cual podrías sentarte. Sin embargo, tu cerebro marca "silla" como una palabra más rápido que "urna." Los psicólogos llaman a esta brecha el efecto de frecuencia de palabras: cuanto más a menudo aparece una palabra en el idioma que nos rodea, más rápido y con mayor precisión la reconocemos.


Tabla de Contenidos

  • ¿Qué es el Efecto de Frecuencia de Palabras?
  • ¿Cómo Funciona el Efecto de Frecuencia de Palabras?
    • El Modelo Logogen
    • El Modelo de Activación Interactiva
    • La Cuenta de Aprendizaje Discriminativo
  • ¿Cómo se Mide la Frecuencia de Palabras?
  • Ejemplos del Efecto de Frecuencia de Palabras en la Investigación
    • Marketing y Persuasión
    • Psicolingüística y Decisión Léxica
    • Desarrollo de la Lectura
    • Reconocimiento de Palabras en Bilingües y Segunda Lengua
  • Preguntas Frecuentes

¿Qué es el Efecto de Frecuencia de Palabras?

Prueba tú mismo: "mesa" y "enrejado." Ambos son sustantivos, ambos tienen dos sílabas, ambos son objetos concretos. Uno de ellos lo etiquetarás como una palabra real casi al instante. El otro tarda un poco más. La única diferencia real entre ellos es cuántas veces te has encontrado con cada uno, y esa diferencia es suficiente para cambiar tu tiempo de reacción.

Frecuencia: el conteo bruto de ocurrencias de una palabra en un corpus real de texto o habla, el equivalente medible de cuán "común" se siente una palabra.

Baayen y sus colegas lo llaman "un fuerte predictor en la mayoría de las tareas de procesamiento léxico" (Heitmeier, Chuang, Axen & Baayen, 2023). Ese poder predictivo está bien establecido. Lo que menos se ha resuelto es por qué ocurre.

¿Cómo Funciona el Efecto de Frecuencia de Palabras?

Cuando encuentras una palabra, tu cerebro tiene que recuperar todo lo almacenado sobre ella: su ortografía, su sonido, su significado. La frecuencia de la palabra cambia cuánto tiempo toma esa recuperación; las palabras de alta frecuencia regresan rápido, las palabras de baja frecuencia regresan más lento. Tres explicaciones explican por qué, en tres vocabularios diferentes.

El Modelo Logogen

La versión clásica es el Modelo Logogen de Morton. Cada palabra que conoces tiene su propio logogen, una unidad de reconocimiento que se activa una vez que se acumula suficiente evidencia para esa palabra. La frecuencia establece cuánta evidencia se necesita: el logogen de una palabra de alta frecuencia tiene un umbral más bajo, así que se activa antes. El logogen de una palabra de baja frecuencia necesita más evidencia, así que se activará más tarde (Lim, 2016).

El Modelo de Activación Interactiva

El Modelo de Activación Interactiva de McClelland y Rumelhart construye esto en un sistema en capas: las características visuales se alimentan a letras, y las letras se alimentan a unidades de palabras completas. En lugar de un umbral fijo, la frecuencia establece el nivel de activación en reposo de cada unidad de palabra. La unidad de una palabra de alta frecuencia comienza más cerca de activarse. La unidad de una palabra de baja frecuencia comienza más lejos (Lim, 2016).

La Cuenta de Aprendizaje Discriminativo

Una cuenta más reciente y computacional lo enmarca de otra manera: como un problema de predicción, no como una carrera de activación. Un sistema entrenado en el lenguaje que realmente has encontrado hace un menor error de predicción para las palabras que ha visto más a menudo. Palabras de alta frecuencia: menor error, reconocimiento más rápido. Palabras de baja frecuencia: mayor error, reconocimiento más lento (Heitmeier, Chuang, Axen & Baayen, 2023).

Todas las teorías mencionadas tienen una cosa en común: la exposición determina cuán rápido una palabra supera cualquier criterio que el modelo esté midiendo. En lo que los tres coinciden, y lo que importa para el diseño del estudio, es que el conteo bruto de frecuencia en sí es un mal predictor. El valor transformado en log- o rango predice el tiempo de reacción con mucha más precisión (Heitmeier, Chuang, Axen & Baayen, 2023). Verás exactamente cómo se ve ese valor transformado en comparación con una palabra real en la siguiente sección.

¿Cómo se Mide la Frecuencia de Palabras?

Los predictores necesitan un número detrás de ellos. Entonces, ¿de dónde proviene realmente ese número?

Una de las principales maneras en que los investigadores han medido la frecuencia de palabras durante décadas fue contando las ocurrencias en material impreso: lectores, libros de texto, la Biblia, los clásicos en inglés, revistas populares, incluso un conjunto de 120 libros infantiles (Thorndike & Lorge, 1944).

Pero las personas no hablan como los libros. Entonces, ¿por qué usar libros como la base principal para representar la frecuencia del lenguaje? Marc Brysbaert y Boris New reconstruyeron el conteo estándar de palabras en inglés americano desde cero, utilizando 51 millones de palabras extraídas de subtítulos de películas y programas de televisión (Brysbaert & New, 2009).

La apuesta dio sus frutos. Al ser probada contra 31,201 palabras reales, su medida basada en subtítulos, SUBTLEX-US, explicó el 62.3% de la varianza en cuán rápido las personas las reconocieron. Las normas antiguas, construidas a partir de prosa editada en inglés impresa en 1961 (Francis & Kučera, 1964), lograron solo el 57.7% (Brysbaert & New, 2009).

Un puñado de entradas reales de ese conjunto de datos SUBTLEX-US muestra la distribución (Brysbaert & New, 2009), desde palabras que aparecen una vez en 51 millones de palabras hasta "el," que aparece en cada una de las 8,388 películas y programas en el corpus:

PalabraFREQcountSUBTLWFSUBTLCDLg10WF
encantamientos10.020.010.3010
consolidación10.020.010.3010
septillizos10.020.010.3010
referente10.020.010.3010
puntillosamente10.020.010.3010
pragmatismo110.220.111.0792
humillado460.900.391.6721
exhibición2074.061.632.3181
fiel4659.124.212.6684
herramienta54810.754.402.7396
botellas68213.375.472.8344
personalidad81115.906.722.9096
encantador4,85395.1629.483.6861
perro9,835192.8436.353.9928
ojos11,299221.5556.824.0531
casado12,163238.4947.114.0851
juntos19,553383.3976.904.2912
mente24,715484.6181.904.3930
Gracias31,789623.3185.234.5023
Dios46,061903.1682.744.6633
Dónde93,3411,830.2298.474.9701
Sí101,8351,996.7697.045.0079
saber291,7805,721.1899.435.4651
el1,501,90829,449.18100.006.1766

Nuevas medidas de frecuencia basadas en la base de datos SUBTLEXUS, nombre de archivo Archivo Excel comprimido 2007 con todas las 74,286 palabras en el corpus

  • FREQcount: el número bruto de veces que la palabra ocurre en todo el corpus de 51 millones de palabras SUBTLEX-US.
  • SUBTLWF: frecuencia de palabras por millón de palabras (FREQcount dividido por 51), la cifra estandarizada que hace que palabras de diferentes tamaños de corpus sean comparables.
  • SUBTLCD: diversidad contextual, el porcentaje de las 8,388 películas y episodios de TV del corpus que contienen la palabra al menos una vez. Una palabra puede ser frecuente pero concentrada en pocos contextos, o moderadamente frecuente pero distribuida en todas partes; esto es lo que captura esa diferencia.
  • Lg10WF: la frecuencia transformada en log10. Este es el valor que realmente predice el tiempo de reacción en experimentos de decisión léxica, no el conteo bruto, razón por la cual los investigadores lo utilizan en lugar de FREQcount para el modelado.

Nota

No hay un corpus universal para medir la frecuencia de palabras. Cualquiera que un investigador use depende del idioma, el diccionario o lista de frecuencias en cuestión, y la aplicación. SUBTLEX-US es un ejemplo ampliamente utilizado en la investigación lingüística en inglés, y se utiliza aquí porque demuestra claramente los conceptos fundamentales detrás del efecto de frecuencia de palabras, no porque sea la única opción. Existen otros corpora para otros idiomas, géneros y necesidades de investigación.

Eso es la variable, definida y medida. Donde realmente aparece, en laboratorios de psicolingüística, en cómo los niños aprenden a leer, en hablantes bilingües, en copias de marketing, es donde las cosas se vuelven interesantes.

Ejemplos del Efecto de Frecuencia de Palabras en la Investigación

Marketing y Persuasión

La frecuencia de palabras no solo se queda en el laboratorio, da forma a cómo las personas responden al lenguaje en general. Las palabras fáciles de procesar simplemente se sienten mejor, un fenómeno que los investigadores llaman fluidez de procesamiento, y la frecuencia de palabras es una de sus palancas más confiables (Bullock, Shulman & Huskey, 2021).

Brady Hodges, Zachary Estes y Caleb Warren lo probaron directamente en eslóganes de marcas: desglosando más de 800 ejemplos reales, utilizando análisis correlacional, experimentos de laboratorio, seguimiento ocular y un estudio de campo, encontraron que los eslóganes construidos a partir de palabras comunes se gustan más (Hodges, Estes & Warren, 2024). ¡Las implicaciones de esto son que los eslóganes construidos a partir de palabras raras es más probable que se recuerden más!

Las implicaciones se pueden aplicar a decisiones comerciales reales. Una marca más nueva, o una que lucha por cuota de mercado, o que entra en territorio desconocido, en realidad se beneficia de un lenguaje más difícil de procesar, es lo que hace que la gente recuerde el nombre más tarde. Para una marca establecida, las matemáticas cambian: ser olvidable apenas les cuesta algo, la gente ya sabe quiénes son, pero ser poco apreciado causa un daño real. Por eso la apuesta más segura para ellos es la palabra fácil y agradable, incluso si es menos memorable (Hodges, Estes & Warren, 2024).

Psicolingüística y Decisión Léxica

Suena casi demasiado simple como para importar: mira una serie de letras, decide si es una palabra real, presiona un botón, lo más rápido que puedas. Ese juicio que se siente trivial es donde el efecto de la frecuencia de palabras es más grande, más grande que la longitud de la palabra, la densidad del vecindario, o cualquier otra cosa que los psicolingüistas suelen culpar por tiempos de reacción lentos.

Heitmeier y colegas lo midieron directamente: la frecuencia explicó "de lejos" la mayor parte de la varianza en la rapidez con que las personas respondieron (Heitmeier, Chuang, Axen & Baayen, 2023).

En el video anterior, se puede ver un ejemplo de la Tarea de Decisión Léxica Dual. Esta tarea presenta al participante dos palabras y el participante debe decidir si ambas palabras presentadas están en inglés o si una no lo está.

Desarrollo de la Lectura

Sarah Gerth y Julia Festman utilizaron el seguimiento ocular en un estudio con 66 niños de habla alemana en quinto y sexto grado, de 10 a 12 años, mientras leían oraciones ordinarias, no palabras aisladas en una pantalla, oraciones reales, leídas de la manera en que un niño realmente lee en la escuela. El resultado: las palabras de baja frecuencia mantenían su mirada un total de 62 milisegundos más que las de alta frecuencia, en lectores que aún estaban aprendiendo a leer con fluidez (Gerth & Festman, 2021).

Pero resultó que la frecuencia era solo la mitad de la historia. Algunos de los niños eran simplemente lectores más rápidos que otros, y la frecuencia de palabras por sí sola no podía explicar por qué.

La longitud de la palabra era la pieza que faltaba. Los niños lectores más rápidos ya habían adquirido un hábito que los más lentos aún no tenían: percibir una palabra común entera de un solo vistazo en lugar de trabajar a través de ella letra por letra, un pequeño pero real paso hacia cómo leen los adultos.

Un diseño modelado en este estudio, con palabras críticas de alta y baja frecuencia incrustadas en oraciones ordinarias, igualadas en longitud de palabra, con métricas de mirada por palabra registradas automáticamente, se demuestra en la página de Segmentación de Texto de Labvanced, construida con el Objeto de Segmentación de Texto.

Reconocimiento de Palabras en Lenguas Bilingües y de Segundo Idioma

Aquí hay un patrón que la mayoría de las personas nunca nota sobre su propio bilingüismo: el efecto de frecuencia de palabras golpea más fuerte en tu lengua más débil. Jens Schmidtke lo midió, los hablantes bilingües muestran un efecto de frecuencia más grande que los hablantes monolingües (Schmidtke, 2014).

Es tentador leer eso como si los cerebros bilingües procesaran el lenguaje de manera diferente. Para este efecto específico, no tienen que hacerlo: dividir tu exposición entre dos lenguas y cada una simplemente recibe menos práctica que la lengua de un hablante monolingüe.

Hazte más fluido y la brecha se estrecha. Una mayor competencia estaba directamente ligada a un efecto de frecuencia más pequeño.

Preguntas Frecuentes

¿Qué es el efecto de frecuencia de palabras en términos simples?
Las palabras comunes, las que escuchas o lees constantemente, se reconocen más rápido que las raras, incluso cuando ambas palabras tienen la misma longitud.
¿Por qué las palabras comunes se reconocen más rápido que las raras?
Repetición. Simplemente has encontrado palabras comunes con mucha más frecuencia, y varios modelos de reconocimiento de palabras describen cómo esa exposición repetida agudiza y acelera el reconocimiento específicamente de palabras de alta frecuencia.
¿Cómo miden los investigadores la frecuencia de palabras?
Contando ocurrencias a través de enormes corpus de textos o discursos. La investigación moderna en inglés se basa en normas derivadas de subtítulos como SUBTLEX-US, y analiza los tiempos de reacción contra el valor de frecuencia transformado por logaritmo o rango en lugar de la cuenta cruda.
¿El efecto de frecuencia de palabras solo se aplica a la lectura?
No. Se presenta en el reconocimiento de palabras visuales, en el reconocimiento de palabras habladas y en tareas de nombrar imágenes, y el tamaño del efecto varía según la tarea y, para hablantes bilingües, por la cantidad de exposición que han tenido al idioma en cuestión.

Conclusiones Clave

  • Las palabras comunes se reconocen más rápido y con mayor precisión que las raras, un hallazgo conocido como el efecto de frecuencia de palabras.
  • Supera a cualquier otra variable que los psicolingüistas prueban, longitud de palabra, densidad de vecindario, como predictor del tiempo de reacción.
  • Usa frecuencia transformada por logaritmo o rango, no cuentas crudas, la frecuencia cruda apenas predice el comportamiento.
  • Los hablantes bilingües sienten el efecto con más fuerza que los hablantes monolingües, porque su exposición a cada lengua está dividida.
  • En eslóganes de marcas, las palabras comunes ganan en agradabilidad y pierden en memorabilidad.
  • La Tarea de Decisión Léxica Dual de Labvanced es un paradigma listo para estudiar este efecto, registrando datos de tiempo de reacción y precisión a nivel de prueba.
  • Para la lectura de oraciones continuas en lugar de palabras aisladas, el Objeto de Segmentación de Texto registra métricas de mirada por palabra automáticamente, demostrado con un estudio de lectura de frecuencia de palabras modelado en Gerth y Festman (2021).

Más conceptos y efectos de psicología, explicados.

Referencias

  1. Brysbaert, M., & New, B. (2009). Moving beyond Kučera and Francis: A critical evaluation of current word frequency norms and the introduction of a new and improved word frequency measure for American English. Behavior Research Methods, 41(4), 977–990.
  2. Bullock, O. M., Shulman, H. C., & Huskey, R. (2021). Narratives are persuasive because they are easier to understand: Examining processing fluency as a mechanism of narrative persuasion. Frontiers in Communication, 6, 719615.
  3. Francis, W. N., & Kučera, H. (1964). A Standard Corpus of Present-Day Edited American English (the Brown Corpus). Brown University.
  4. Gerth, S., & Festman, J. (2021). Reading development, word length and frequency effects: An eye-tracking study with slow and fast readers. Frontiers in Communication, 6, 743113.
  5. Heitmeier, M., Chuang, Y.-Y., Axen, S. D., & Baayen, R. H. (2023). Frequency effects in linear discriminative learning. Frontiers in Human Neuroscience, 17, 1242720.
  6. Hodges, B. T., Estes, Z., & Warren, C. (2024). Intel inside: The linguistic properties of effective slogans. Journal of Consumer Research, 50(5), 865–886.
  7. Lim, S. W. H. (2016). The influence of orthographic neighborhood density and word frequency on visual word recognition: Insights from RT distributional analyses. Frontiers in Psychology, 7, 401.
  8. Schmidtke, J. (2014). Second language experience modulates word retrieval effort in bilinguals: Evidence from pupillometry. Frontiers in Psychology, 5, 137.
  9. Thorndike, E. L., & Lorge, I. (1944). The Teacher's Word Book of 30,000 Words. Teachers College, Columbia University.