产品能力/认知评估

一份用得上的,
认知画像。

36 个标准化认知任务,覆盖 记忆能力 / 空间能力 / 思维能力 / 语言能力 / 反应速度 / 专注能力 六大能力域。任务内容与已发布生产目录保持一致, 单项推荐时长为 3–12 分钟。

36
已发布任务
6
认知能力域
3–12 分钟
推荐时长
适用人群
关联能力
筛选结果 36 / 36 个评估任务

识字量(小学一至三年级)

认知评估

汉字识别(识字量)是国内发展性阅读障碍研究筛选判据的核心条件:各研究以汉字识别成绩低于同龄或同年级平均 1~2 个标准差为入组条件之一(中国当代儿科杂志 2018 用王孝玲量表取 2 个标准差;心理学报 2019、Xue, Shu, Li 2013、Song 等 2020 取 1.5 个标准差;综述建议统一 −1.5 SD)。国内纸笔识字量测验多为产出式——王孝玲、陶保平版让儿童把目标字组词或写句(10 组 210 字按认识率分层抽样,三年级信度 0.975–0.982),洪儷瑜版与 CCST 写注音并造词。静默识别式与口头认读并存于同一测验的先例是李辉 1999 学前及初小儿童中文识字量表:字图匹配 / 听音指字(选择式)与指字认字 / 认字说话(口头式)四个分量表间相关 .36–.94。真假字判断在一至三年级正确率接近机会水平(49–50%,Guan & Fraundorf 2020),不宜作识字量指标,故本任务采用「字—读音」与「字—搭配成词」两类判断。一年级内识字量个体差异极大(150 字口头识别入学追踪四时点 26±22 → 78±22),同一年级层内差异远大于层间差异,本任务据此只出分层描述、不给识字量字数。识别式判断的认知负荷低于产出式,测得的困难程度系统性偏轻,不与纸笔版折算,也不得用于阅读障碍筛选判据。文献出处见 Doc/顶层设计/认知评估/识字量测量蓝图-V1.md §11。

5 分钟语言能力character_recognition

听觉数字倒序记忆

认知评估

听觉数字倒背是数字广度范式倒背分测验的标准施测形态:数字以每秒约一个的速度逐个念出,被评者在听完后按与呈现相反的顺序复述。相对视觉呈现,听觉呈现不提供可反复扫视的视觉表象,被评者必须依赖语音环路保持信息,测得的言语工作记忆成分更纯粹;倒背相对顺背额外要求中央执行对保持内容进行反转操作,是工作记忆容量与操作效率的经典测量。

6 分钟记忆能力digit_span

数字倒序记忆

认知评估

数字倒背属于数字广度范式的倒背分测验:数字逐个呈现后,要求被评者按与呈现相反的顺序复述,逐步增加数字串长度,观察能够准确逆序复现的最长水平。相对顺背只考察序列的存储与保持,倒背额外要求在工作记忆中对序列进行操作,主要考察中央执行对语音环路内容的操控能力,是工作记忆容量与操作效率最经典的测量之一。

6 分钟记忆能力digit_span

视觉搜索速度

认知评估

视觉搜索是选择性注意研究的经典范式。特征整合理论(Treisman & Gelade, 1980)区分两类搜索:目标只在单一特征上与干扰项不同时(如红点在蓝点中)会「一眼跳出」,反应时不随阵列大小变化;目标需要同时满足两个特征(联合搜索,如红色圆点在红色方块与蓝色圆点中)时,注意必须逐个投向候选项,反应时随阵列大小线性增长,其斜率(毫秒/项)是注意分配效率的直接量。Wolfe(1998)对大量实验的汇总给出联合搜索目标存在题斜率约 20~40 毫秒/项、目标不存在题约为其两倍。本任务采用联合搜索材料,阵列大小分三档、目标出现率一半,用目标存在且答对试次的反应时对阵列大小做线性回归,斜率为主指标、截距为与搜索无关的感知与动作基线;漏报率与误报率作为信号检测层面的辅助证据。

5 分钟专注能力visual_search

限时口算流畅(小学一至三年级)

认知评估

计算流畅性(arithmetic fluency)指在限定时间内正确完成基础算术题的数量,是学业数学能力的直接指标。Geary(2004)把数学学习困难的核心缺陷分为两类:算术事实提取困难(简单事实无法自动从记忆中取出,只能靠数数)与计算程序困难(进位、借位等多步程序执行出错或极慢)。Jordan、Hanich 与 Kaplan(2003)的纵向研究显示算术事实流畅性能预测后续数学困难;Fuchs 等(2005)用一年级的限时计算作为筛查工具。本任务采用识别式四选一形态:每题呈现一道加减算式与四个候选得数,被评者按编号作答,限时两分钟尽量多做。题目分为无进位借位与有进位借位两个等权条件,前者接近数学事实的直接提取,后者需要多步计算程序,两条件的正确率与反应时之差对应上述两类缺陷;四个候选得数中的干扰项按进位借位遗漏、邻近事实、运算符混淆三类常见错误构造,答错时选中的是哪一类干扰项可作离线分析。主指标为限时内正确数。

4 分钟思维能力arithmetic_fluency

点阵数量比较

认知评估

非符号数量比较任务测量近似数量系统(Approximate Number System)的敏锐度:被评者在无法逐个计数的时间内判断两组点阵哪一组更多,正确率随两组数量比值接近而下降。Halberda、Mazzocco 与 Feigenson(2008)发现该敏锐度与数学成就显著相关且独立于一般智力;Piazza 等(2010)报告计算障碍儿童在该任务上存在明确缺陷;Nosworthy 等(2013)的纸笔限时版把符号与非符号各测 1 分钟,本任务采用其非符号段的 60 秒口径。题目按两组数量比值分为四档,并在总面积与数量的方向上等量分为同向、反向两组条件,使被评者无法靠比较墨迹多少作答。本任务与符号数量比较配对使用:两项完成量的差值,是判断困难出在数字符号还是出在数量概念本身的直接依据。

3 分钟思维能力nonsymbolic_magnitude_comparison

数字大小冲突判断

认知评估

数量 Stroop(size-congruity)任务测量阿拉伯数字所表征数量的自动化通达程度。核心科学现象是尺寸一致性效应:当数值大小与物理字号冲突时,反应时显著长于两者一致时,差值反映数值信息在无需刻意提取时被激活的强度。Henik 与 Tzelgov(1982)首次系统报告该效应;Rubinsten 与 Henik(2005)发现计算障碍儿童的效应模式与对照组不同,提示数量表征自动化不足是数学学习困难的一条独立线索。本任务采用个位数(1~9)符号版,一致 / 不一致 / 中性三条件等量呈现,三条件共用同一组数字对以使比值距离分布完全一致,避免距离效应混入冲突效应。

4 分钟思维能力numerical_stroop

拼音解码(小学一至三年级)

认知评估

语音意识缺陷在中国发展性阅读障碍儿童中的合并占比 41%(95% CI 31–52%),与被文献称为核心缺陷的快速命名(44%)仅差 3 个百分点且置信区间大幅重叠(22 篇 / 26 项研究 / 1,284 名阅读障碍儿童的系统综述与元分析)。3–12 岁汉语儿童声、韵、调意识与早期阅读的元分析(59 篇 / 94 独立样本 / 12,514 人)显示声调意识与阅读的相关 r=0.37 最高,声韵母 0.27,音素 0.23;按阅读阶段分层,识字期(6–7 岁 / 一年级)r=0.33 为峰值。拼音读写在一年级已基本发展成熟,是后续阅读理解的首要预测因子,可作为读写困难早期筛查的代理指标。本任务采用汉语语音意识测验六类经典范式之一的「检测匹配项」:A 族字音匹配只用一二年级识字表内高频字把识字降为非瓶颈;B 族看图辨拼音呈现孩子叫得出名字的图形与一串拼音,孩子必须把拼音拼读出来再与名字比对才能作答,不依赖识字,也无法靠比对字母形状猜对。错误项全部是真实音节,按声母对比 / 前后鼻音 / 声调 / 介音复韵母四类干扰族有计划构造,声调题依上述效应量加权。识别式判断的认知负荷低于朗读产出,测得的困难程度系统性偏轻,本任务不给出与朗读版的折算。文献详见 Doc/顶层设计/认知评估/拼音解码测量蓝图-V1.md §11。

5 分钟语言能力pinyin_decoding

符号数量比较

认知评估

符号数量比较任务测量个体对阿拉伯数字所表征数量的通达效率。核心科学现象是距离效应:两数比值越接近,判断越慢、错误越多,反映数量表征在心理数轴上的重叠程度。Nosworthy 等(2013)发现该任务的纸笔限时版能解释小学生算术成绩的显著方差,且独立于一般智力;Brankaer 等(2017)在此基础上发布了可课堂群体施测的 SYMP Test。本任务采用个位数(1~9)符号版,题目按比值分为近、远两组等权呈现,以在限时完成量之外保留距离效应证据。

3 分钟思维能力symbolic_magnitude_comparison

短句阅读理解(小学一至三年级)

认知评估

阅读理解的简单观(Simple View of Reading)把阅读理解拆为解码与语言理解两个成分;学习困难综合筛查的阅读线此前三项(语素意识、同音字辨析、正字法意识)都在字词层,本任务补上语言理解侧最小单位——句子层语境整合:读完前半句后,能否把它建立的情境、因果、时间与指代关系带进后半句判断连贯性。本任务采用语境完型范式(sentence completion / context fit judgment):每题呈现一个前半句与一个补全句,判断「这样接下去对吗」;同一个前半句在两侧各出现一次(一条连贯补全、一条不连贯补全),被试无法靠前半句眼熟作答。不连贯补全按因果颠倒、转折忽略、指代错位、时间顺序矛盾四类反例族有计划构造,且每条换一个前半句都能成立,排除靠常识不读前半句就能判的荒谬句。合适句命中与不合适句误接受经 log-linear 校正合成 d′,即语境连贯辨别力。题库全部用一二年级常用字,识字量被压成非瓶颈。

6 分钟语言能力sentence_completion

正字法意识

认知评估

汉语正字法表征(orthographic representation)指字形与音、义的稳定绑定。形近字混淆反映正字法表征的精细度不足,与同音替代(音—形绑定失稳)对应不同的加工缺陷;正字法知识缺陷在汉语发展性阅读障碍中的合并检出率约 43%(https://pmc.ncbi.nlm.nih.gov/articles/PMC9139287/),与快速命名并列最高。本任务采用正字法判断范式(orthographic decision):逐题呈现一个双字词,一半是含形近混淆字的正确写法,一半是把一个字换成形近而不同音常用字的错字词(部件替换 / 笔画增删 / 部件位置颠倒三类干扰),要求判断「写对了吗」。真词命中与错字误报经 log-linear 校正合成 d′,即对形近错字的检出敏感度;替换字与原字去声调后音节不同,排除同音混淆(属同音字辨析任务)。

5 分钟语言能力lexical_decision

同音字辨析

认知评估

汉语正字法表征(orthographic representation)指字形与音、义的稳定绑定。同音替代错误在汉语阅读困难儿童的书写错误中占比最高,反映正字法表征的精细度不足;正字法知识缺陷在汉语发展性阅读障碍中的合并检出率约 43%(https://pmc.ncbi.nlm.nih.gov/articles/PMC9139287/),与快速命名并列最高。本任务采用正字法判断范式(orthographic decision):逐题呈现一个双字词,一半是含同音混淆字的正确写法,一半是把一个字换成严格同音同调常用字的错字词,要求判断「写对了吗」。真词命中与错字误报经 log-linear 校正合成 d′,即对同音错字的检出敏感度;错字与原字同音同调,排除读音线索。

5 分钟语言能力lexical_decision

语素意识

认知评估

语素意识(morphological awareness)指对词内部语素及其意义的觉察与操作能力。汉语以复合构词为主,同形语素在不同词中的语素义差异是常见的理解障碍来源,语素意识因此成为汉语阅读能力的稳定预测因子之一。本任务采用同形语素判断范式:呈现共用同一个字的两个词,要求判断该字在两词中语素义是否相同,共用字读音在两词中保持一致,以排除读音差异对判断的干扰。题目按「字义相同 / 不同」与「两个词整体相关 / 无关」交叉平衡,各占四分之一,共用字在词中的位置在四类题中分布一致,只凭两个词像不像或共用字位置作答无法取得高分。

5 分钟语言能力word_semantic_judgment

词汇识别与判断

认知评估

词汇决策是语言认知研究中的经典范式,通过比较真实词与非词的识别表现,考察心理词典的词汇通达速度、准确性和语言加工效率表现。

5 分钟语言能力lexical_decision

图形特征匹配

认知评估

特征匹配范式通过操纵颜色、形状或数量等目标特征,比较匹配与不匹配条件下的表现,考察知觉辨别、选择性注意和信息比较效率表现。

5 分钟专注能力feature_matching

空间位置记忆

认知评估

科西方块属于视觉空间工作记忆广度范式,通过逐步增加空间位置序列长度,观察个体能够准确复现的水平,考察空间编码、顺序保持和工作记忆容量。

6 分钟记忆能力corsi_block_tapping

句子理解与判断

认知评估

本任务采用语法推理范式(Baddeley 1968 句图核对)的中文化版本:每题呈现两个叠在一起、一个挡住另一个的图形,并给出一句描述,判断句子是否与图相符。句子按「主动 / 被动」(如「圆形挡住了方块」/「方块被圆形挡住了」)与「肯定 / 否定」交叉形成四种句式,每种句式中对句与错句各半,每场按句式等量抽题。被动句要求把先出现的名词理解为被作用的一方,否定句需要额外翻转真值,两者都会增加句法加工负荷;只凭「先提到的图形在前面」或「有否定词就选错」作答无法取得高分。

4 分钟语言能力grammatical_reasoning

数字顺序连线

认知评估

连线测验 A 属于 Trail Making Test A 范式,通过按数字顺序连接分散目标,综合考察视觉搜索、注意维持、顺序加工和视觉运动速度。

5 分钟反应速度trail_making_a

数字规律推理

认知评估

数字规律属于数列归纳推理范式,需要比较数字之间的变化关系、提出并验证规则,再推断序列信息,考察流体推理、数量关系加工和工作记忆。

7 分钟思维能力number_series

快速选择反应

认知评估

选择反应时属于心理时间测量中的经典范式,要求先辨别刺激类别,再选择对应反应;反应时会受到信息辨认、决策选择和动作执行共同影响。

5 分钟反应速度choice_reaction_time

灵活切换连线

认知评估

本任务参考 Trail Making Test-B 的交替连线规则,但当前为 9 个目标节点与渐进空白干扰的内部演示变体,不等同于标准 TMT-B 材料或测量程序。

7 分钟思维能力trail_making_b

数字顺序记忆

认知评估

数字广度属于工作记忆广度范式,通过逐步增加数字序列长度,观察个体能够准确复现的最长水平,主要考察序列编码、短时保持和顺序提取能力。

3 分钟记忆能力digit_span

空间旋转

认知评估

心理旋转是空间认知研究中的经典范式,通过比较不同角度呈现的图形是否为同一结构,考察内部空间表征、心理变换和视觉比较过程。

4 分钟空间能力mental_rotation

灵活切换

认知评估

任务切换混合代价是执行功能研究中的经典指标,通过比较单一规则纯块与双规则混合块的反应差异,反映同时维持和更新多套任务规则所增加的认知负担。

5 分钟思维能力task_switching

语境理解与补全

认知评估

语境完型属于句子完形与语言推断范式,需要整合前后文语义、预测缺失信息并比较候选表达,考察语言理解、语境推断和工作记忆过程。

6 分钟语言能力sentence_completion

关系类比推理

认知评估

类比推理属于关系迁移范式,需要先识别已知对象之间的关系结构,再将相同结构应用于新对象,考察关系整合、抽象推理和知识迁移。

7 分钟思维能力analogical_reasoning

路线规划

认知评估

路线规划任务要求在障碍约束下形成并执行从起点到终点的路径。路径效率描述实际路线接近最优路线的程度;完成率、规划时间和超时情况用于补充说明执行过程。

10 分钟空间能力grid_navigation

动态工作记忆

认知评估

这类任务在心理学里叫 N-back,是国际上测工作记忆更新最常用的方法之一。难点不在记得多,而在于不断替换:每出现一个新图形,就要把最早的那个放掉。结果分别看两件事——能不能分清「一样」和「不一样」,以及在更难的档位上还能不能保持准确。

5 分钟记忆能力n_back

规律分类

认知评估

异类排除属于归纳推理与概念分类范式,需要先提取多数项目的共同属性,再判断偏离该规则的项目,考察规则发现、类别形成和关系比较。

6 分钟思维能力odd_one_out

即时反应速度

认知评估

简单反应时范式尽量减少选择和判断成分,记录刺激出现到动作启动的时间,主要考察感觉信息传入、运动准备和执行之间的基础时间效率。

5 分钟反应速度simple_reaction

图形规律推理

认知评估

矩阵推理是流体推理与归纳推理领域的经典范式,理论上承接 Raven 渐进矩阵和 CHC 智力结构模型,关注个体从视觉关系中提取规则并完成抽象推断的能力。

8 分钟思维能力matrix_reasoning

抗干扰注意

认知评估

侧抑制属于 Flanker 冲突范式,通过比较目标刺激与周围干扰刺激一致或冲突时的表现,考察选择性注意、干扰抑制和冲突加工。

5 分钟专注能力flanker

抗干扰颜色判断

认知评估

色词冲突属于 Stroop 范式,通过操纵词义与字色的一致和冲突条件,比较冲突带来的反应变化,考察选择性注意、反应抑制和冲突解决。

5 分钟专注能力stroop_color_word

持续警觉

认知评估

持续警觉反应任务(SART)通过高频常见刺激与低频目标刺激的反应控制,观察注意随时间变化及错误反应情况,考察持续注意和反应抑制。

4 分钟专注能力sart

空间构图

认知评估

积木图案属于空间构造范式,要求根据目标图形分析组成部分及其空间关系,再完成整体重构,主要考察视觉空间分析、结构整合和视觉运动协调。

12 分钟空间能力block_design

词义理解

认知评估

词义判断属于语义判断范式,需要激活并比较词语在长时记忆中的语义表征,结合正确率和反应时考察语义通达速度、词义理解和关系判断。

8 分钟语言能力word_semantic_judgment
§ 1 · GET STARTED

在机构工作台,
使用 36 个认知任务。

本页认知评估任务当前通过机构工作台交付,不属于开放平台正式支持的四类产品。 开放平台现支持 AI 测评、量表测评、综合方案与六维画像,具体以 API 文档为准。