用圖片考小朋友,會唔會考低咗?

肯雅 192 名 2–7 歲 · 美國 96 名 2–3 歲 · 兩個預註冊實驗 · Developmental Psychology 2025

來源・背景

肯雅 192 名 2–7 歲 · 美國 96 名 2–3 歲 · 兩個預註冊實驗 · Developmental Psychology 2025。先講清楚研究出處、樣本,同為何值得家長知。

這份導讀根據什麼寫成

論文Investigating the validity of picture-based assessments across cultures and contexts: Evidence from young children in Kenya and the United States.
作者Rebecca Zhu;Tabitha Nduku Kilonzo;Jan M. Engelmann;Alison Gopnik
期刊Developmental Psychology(2025)
DOI10.1037/dev0002050
PubMedPMID 40758294
公開摘要作者 Kudos 白話摘要

本頁為科普整理,非論文全文。引文逐字取自上述公開來源(程式驗證);比喻與育兒建議為本站整理,會標明。

Researchers frequently use picture-based assessments across cultures and contexts.—— 論文摘要(PubMed)
We found that preschoolers in a Kenyan context (Mombasa County) were more accurate on an object-based vocabulary assessment than a picture-based vocabulary assessment, whereas toddlers and preschoolers in an American context (San Francisco Bay Area) were equally accurate on an object-based vocabulary assessment and a picture-based vocabulary assessment.—— 論文摘要(PubMed)
Consequently, these results tentatively suggest that assessments involving pictures may underestimate children's capacities in some contexts.—— 論文摘要(PubMed)
To accurately measure developing capacities in children from diverse backgrounds, it is critical that assessment tools are appropriately adapted to environmental contexts.—— 論文摘要(PubMed)

好多評估都靠圖片

兒童發展同語言評估好常用圖片:詞彙卡、睇圖講名,甚至智力評估都有大量圖片題。呢個做法背後有個假設:小朋友理解圖片,同理解實物一樣咁直接。喺繪本、圖卡滿屋嘅家庭,呢個假設好少被質疑,因為孩子自細就係對住圖片學嘢。

唔係每個環境都一樣

但世界上有好多小朋友,生活環境入面圖片相對少,例如肯雅 Mombasa County。如果一個孩子平時少接觸圖片,用圖片考佢詞彙,可能唔係考「識唔識呢樣嘢」,而係考「熟唔熟圖片」。呢個分別直接影響評估結果係唔係公平。

點解香港家長要知

香港家庭通常屬「圖片多」嘅環境(繪本、卡通、手機),形勢接近研究嘅美國樣本,唔係肯雅樣本。但小一面試、學校評估、語言測試都大量用圖片。知道「同一能力,用實物同用圖片考可以有落差」,家長先睇得懂評估結果嘅邊界。

核心模型

把研究嘅關鍵變項同結果連起來:邊條線有訊號、邊條冇。

實驗一 · 192 名
實驗一 · 192 名
實驗二 · 96 名
實驗二 · 96 名
肯雅組較準確
肯雅組較低
美國組相若
美國組相若
結果推論
結果推論
建議
肯雅 Mombasa
環境圖片少
實物詞彙任務
圖片詞彙任務
美國灣區
環境圖片多
實物高於圖片
β = 0.07
兩種相若
β = 0.02
圖片評估或
低估能力
工具要配合
環境
圖一:依本論文嘅研究設計整理。圖為本站依論文內容重繪,非論文原圖。
背景

好多評估都靠圖片刺激

論文開頭就點出矛盾:兒童評估大量使用圖片刺激,但唔同環境嘅孩子,接觸圖片嘅數量差別好大。呢個「經驗差距」係整篇研究嘅出發點,亦係作者認為評估可能唔公平嘅原因。

Many childhood assessments rely on picture stimuli, but children in diverse early environments possess varying amounts of experience with pictures.—— 論文摘要(PubMed)
設計

兩個預註冊實驗

研究做咗兩個預先註冊(preregistered)嘅實驗,2022 至 2023 年進行,一個喺肯雅、一個喺美國,問同一條問題:用圖片做嘅評估,喺唔同環境係唔係一樣有效。預註冊即做法同分析事先登記,減少事後改假設嘅空間。

Two preregistered experiments, conducted in 2022-2023, investigated whether picture assessments are valid across diverse contexts.—— 論文摘要(PubMed)
肯雅組

192 名孩子,實物考得好啲

肯雅 Mombasa County 嘅 192 名孩子(2–7 歲,85 名女仔,全部係 Black),處於入學第一個月,環境圖片相對少。佢哋做實物詞彙任務嘅準確度,高過做圖片詞彙任務(β = 0.07, p 值低於 .001)。

Low-to-middle-income children ( n = 192, 2-7 years, 85 females, all Black) in their first month of formal schooling in Mombasa County, Kenya, an early environment with relatively few pictures, performed more accurately on an object vocabulary task than a picture vocabulary task (β = 0.07, p < .001; Experiment 1).—— 論文摘要(PubMed)
美國組

96 名孩子,兩種考法相若

美國三藩市灣區嘅 96 名孩子(2–3 歲,52 名女仔,以白人同亞裔為主),環境圖片相對多。佢哋做實物同圖片詞彙任務嘅表現相若(β = 0.02, p = .60),統計上唔顯著,即係話兩種呈現方式拉唔開差距。

Middle-to-high-income children ( n = 96, 2-3 years, 52 females, predominantly White and Asian) in the San Francisco Bay Area, an early environment with relatively more pictures, performed similarly on object and picture vocabulary tasks (β = 0.02, p = .60; Experiment 2).—— 論文摘要(PubMed)
作者總結

作者白話版點講

作者嘅白話摘要講得直接:肯雅嘅學前兒童做實物詞彙評估較準確,美國嘅幼兒同學前兒童兩種評估一樣準確。即係話,同一種「睇圖講名」嘅考法,喺唔同環境嘅表現並不相同。

We found that preschoolers in a Kenyan context (Mombasa County) were more accurate on an object-based vocabulary assessment than a picture-based vocabulary assessment, whereas toddlers and preschoolers in an American context (San Francisco Bay Area) were equally accurate on an object-based vocabulary assessment and a picture-based vocabulary assessment.—— 作者公開摘要(Kudos)
結論

評估工具要配合環境

作者嘅結論措辭好謹慎:用圖示評估,有可能低估某啲環境下孩子嘅能力。跟住提出建議——要準確量度唔同背景孩子嘅能力,評估工具就必須因應環境調整。留意係「tentatively suggest」,即初步提示而唔係定論。

Consequently, these results tentatively suggest that assessments involving pictures may underestimate children's capacities in some contexts.—— 論文摘要(PubMed)

互動工具:發現檢驗器

揀兩個條件,看看這篇研究預期會見到什麼結果。

速查表
項目結論說明
肯雅樣本192 名2–7 歲,85 名女仔,入學第一個月。
美國樣本96 名2–3 歲,52 名女仔,三藩市灣區。
肯雅結果β = 0.07實物詞彙任務準確度顯著高過圖片任務。
美國結果β = 0.02兩種任務相若,p = .60,唔顯著。
作者結論初步提示圖片評估可能有時低估某啲環境孩子嘅能力。
設計預註冊兩個實驗,2022–2023 年收集數據。

親子對話卡

圖片卡係學校同評估常用嘅工具,但同一樣能力,用實物考同用圖片考可以有落差。以下 5 張卡幫你分清「唔識」同「唔熟」。研究對象係肯雅 2–7 歲同美國 2–3 歲孩子,你個仔 5–6 歲,睇原則就好。

實物先,圖片後

你摸下呢個(生果/杯),係咩嚟?摸完我哋再睇圖片版,睇你係唔係一樣答得出?

論文見到肯雅組用實物考詞彙準確度高過用圖片(β = 0.07);本站整理:先實物後圖片,孩子少一層「翻譯」。

5–6 歲適用(原研究含 2–7 歲肯雅兒童)

實物同圖片都認得

呢張圖係咩?我哋一齊喺屋企搵出實物,睇下係唔係同一樣嘢?

本站整理:兩邊都配得上,才算真正掌握詞彙,而唔係靠記住圖形。

5–6 歲適用

唔用一次測試貼標籤

今日你答唔到唔緊要,我哋隔幾日再玩一次好唔好?

研究提示單一形式嘅評估可能低估能力;本站整理:一次分數唔等於能力,熟練度要時間累積。

5–6 歲適用

陌生大人同陌生場合

如果老師問你嘅時候你唔想講,可以話「我想用手指一下」,好唔好?

本站整理自「環境同形式會影響表現」嘅發現方向:容許另一種作答方式,會更公平。

5–6 歲適用

兩邊語言都可以講

呢樣嘢廣東話叫咩?英文又係咩?兩樣都講吓。

研究量嘅係環境圖片經驗嘅影響;本站整理:雙語孩子兩種語言嘅詞彙可以互相幫手。

5–6 歲適用

對話卡為本站依本研究嘅發現方向整理,唔係論文原文;可以直接讀出嚟用。

研究導覽

由研究問題、樣本、方法,到主要發現、對 5–6 歲嘅意義、限制同家長可做嘅事。

01呢篇研究想答咩?
  • 核心問題:兒童評估好常用圖片(詞彙卡、睇圖講名),但呢個做法喺唔同文化同環境,係唔係一樣有效?
  • 背景事實:唔同環境嘅孩子,接觸圖片嘅數量差別好大,但評估工具通常唔理呢個差別。
  • 兩個實驗都係預註冊:做法同分析事先登記,減少「睇到結果才改假設」嘅空間。
  • 研究員嘅預期方向:如果孩子圖片經驗少,圖片版任務有機會低估佢真實能力。
問題圖片評估係唔係通用
設計兩個預註冊實驗
年份2022–2023
02幾多人、幾歲、邊度?
  • 肯雅 Mombasa County:192 名孩子,2–7 歲,85 名女仔,全部係 Black,處於入學第一個月。
  • 肯雅組屬低至中等收入家庭,該環境圖片相對少(原文:relatively few pictures)。
  • 美國三藩市灣區:96 名孩子,2–3 歲,52 名女仔,以白人同亞裔為主。
  • 美國組屬中至高收入家庭,該環境圖片相對多(原文:relatively more pictures)。
  • 兩地樣本年齡層唔完全一樣(美國組只到 3 歲),所以直接互比要小心。
肯雅192 名 · 2–7 歲
美國96 名 · 2–3 歲
資料期2022–2023
03佢哋點樣做?
  • 每個孩子做兩種詞彙任務:一種用實物,一種用圖片,內容係同一類詞彙。
  • 兩個實驗設計相同,只係地點、樣本同環境唔同,方便直接對照。
  • 量度嘅係準確度(答對幾多),唔係反應時間,所以呢頁講嘅都係「準確度」。
  • 肯雅樣本處於入學第一個月,作者以呢個時點代表「圖片經驗少」嘅環境。
任務實物 vs 圖片
量度詞彙準確度
對照兩個實驗設計相同
04發現一:肯雅孩子實物考得好啲
  • 肯雅組做實物詞彙任務嘅準確度,顯著高過圖片詞彙任務(β = 0.07, p 值低於 .001)。
  • 同一批孩子、同一類詞彙,只係換咗呈現方式(實物/圖片)就已經有差距。
  • 方向同作者預期一致:圖片經驗少,用圖片考就較吃虧。
  • 呢個係組內比較(同一批孩子做兩件事),所以唔受兩地孩子本身差異影響。
肯雅係數β = 0.07
顯著性p 值低於 .001
方向實物高於圖片
05發現二:美國孩子兩種差不多
  • 美國組做實物同圖片任務嘅表現相若(β = 0.02, p = .60),統計上唔顯著。
  • 呢組孩子 2–3 歲,環境圖片相對多,情況同肯雅組相反。
  • 同一個設計、同一類任務,兩地結果唔同 —— 差距唔係來自任務本身。
  • 要注意美國樣本比肯雅樣本細(96 對 192),年齡亦只到 3 歲。
美國係數β = 0.02
顯著性p = .60
方向兩者相若
06兩地一比:同一把尺唔同結果
  • 兩個實驗用同一套邏輯:實物任務同圖片任務,睇組內差距。
  • 肯雅組差距明顯,美國組差距近乎零 —— 環境圖片經驗係最合理嘅解釋方向。
  • 但作者強調結果只係 tentatively suggest(初步提示),唔係鐵證。
  • 如果直接把兩地分數互比就會誤導,因為樣本環境同年齡同時唔同。
肯雅差距明顯
美國差距近乎零
推論同環境圖片經驗相關
07研究點解要信得過?
  • 兩個實驗都係預註冊,做法同分析事先登記,減少事後調整假設嘅空間。
  • 每個孩子都做足兩種任務(組內設計),唔係兩組人各做一種,減少組間差異干擾。
  • 數據喺 2022 至 2023 年收集,兩地條件年份相近,減少年代因素。
  • 樣本有性別同收入描述(85 名女仔/52 名女仔),透明度較高。
預註冊兩個實驗
設計組內比較
期2022–2023
08對我個 5–6 歲仔嘅意義
  • 年齡部分重疊:肯雅組 2–7 歲包含你仔嘅 5–6 歲,但美國組只到 3 歲,唔算同齡。
  • 香港家庭屬「圖片多」嘅環境,形勢較接近美國樣本,唔係肯雅樣本。
  • 所以唔可以直接搬「用圖片會考低咗」落你仔身上;可以借用嘅係「呈現方式會影響表現」呢個原則。
  • 日常例子:孩子識講「呢個係蘋果」,但指住圖片講唔出,唔一定係唔識,可能係唔熟圖片形式。
  • 小一面試同學校評估大量用圖片,如果表現同日常落差大,值得問「係唔係題目形式問題」。
研究年齡2–7 歲(肯雅)
你嘅孩子5–6 歲
可用部分原則 · 唔係數值
09家長可以點做(本站整理)
  • 教新詞時實物優先:摸得到、用得到嘅嘢先講名,之後再配圖片。
  • 圖片詞彙要重複曝光:同一批圖片隔幾日再玩一次,熟練度本身會影響表現。
  • 玩「實物配圖片」配對遊戲:兩邊都配得上,才知係真正掌握定係靠圖形記憶。
  • 唔好用單一次圖片測試判斷能力高低,尤其喺陌生場合、陌生大人面前。
  • 如果評估表現同日常認知落差大,可以問學校可否用實物或另一種形式再試。
做法一實物先於圖片
做法二重複曝光
做法三實物配圖片
10唔可以宣稱咩?
  • 唔可以講「用圖片評估一定錯」;作者用 tentatively suggest,冇話係定論。
  • 唔可以講「香港孩子一定有呢個問題」—— 香港屬圖片多環境,研究冇量過香港。
  • 唔可以講因果:環境同表現嘅關係係跨情境比較,唔係隨機分派環境。
  • 兩地樣本嘅年齡、收入、族裔同時唔同,好多因素一齊變,唔可以只歸因環境圖片。
  • 美國樣本只到 3 歲,唔可以直接推去學齡階段嘅評估結果。
性質實驗 · 跨情境比較
限制環境非隨機分派
樣本兩地條件唔同
11同日常觀察嘅關係
  • 好多家長見過孩子「識實物唔識圖」,呢篇研究提供一個系統化嘅解釋方向。
  • 幼稚園用圖卡教學本身冇問題;重點係唔好用單一形式判斷能力高低。
  • 語言評估同智力評估都有大量圖片題,理解工具嘅假設就理解結果嘅邊界。
  • 雙語家庭孩子兩邊環境嘅圖片密度唔同,形式上嘅落差有機會更明顯。
日常現象識實物唔識圖
主流做法圖卡教學
提示單一分數有邊界
12一分鐘總結
  • 兩個預註冊實驗,肯雅 192 名(2–7 歲)同美國 96 名(2–3 歲)孩子,問圖片評估係唔係跨環境有效。
  • 肯雅組實物考得好過圖片(β = 0.07, p 值低於 .001);美國組兩種相若(β = 0.02, p = .60)。
  • 作者結論:圖片評估有機會低估某啲環境下孩子嘅能力,評估工具要配合環境調整。
  • 家長用法:實物教詞、圖片多次重複、唔好用單一次圖片測試判斷能力。
  • 香港孩子屬圖片多環境,借用「呈現方式會影響表現」嘅原則就好,唔好套用結論。
樣本192 名 + 96 名
肯雅 β0.07
美國 β0.02
圖片經驗愈多,實物同圖片差距愈細 0255075100最少偏少中等偏多最多實物減圖片差距(相對值 · 示意) 最少100偏少74中等48偏多22最多6圖片經驗愈多,實物同圖片差距愈細(實物減圖片差距(相對值 · 示意))
圖說:x 軸係孩子環境嘅圖片經驗(由少到多),y 軸係「實物考法減圖片考法」嘅準確度差距;數值由本站依論文趨勢(肯雅 β = 0.07 對美國 β = 0.02)整理嘅相對值。研究只有兩個環境嘅實測點,曲線係示意插值,唔係論文原圖。