← 返回 PaperDaily
大模型与智能体
ICER 2026:别再傻傻画图了!编程教育工具设计必须先读懂学生心理
你以为给小白配一套代码、内存、比喻三管齐下的可视化工具,他们就会感恩戴德、学习效率飙升?多伦多大学用眼动追踪和深度访谈告诉你:真相恰恰相反。学生们宁可自己吭哧吭哧手动追踪代码,也不想让工具“替”他们思考,甚至觉得那些可爱的比喻图“太幼稚”不符合大学生身份。这篇ICER 2026的论文,撕开了工具设计的认知面纱,直抵学习者的心理与社会动机,给你一个重新审视编程
龙哥读论文
发布于 2026-08-14 21:47:10
阅读 3
查看原文
🐉 龙哥读论文知识星球来了! 公众号每日8篇拆解不够看?星球 无上限更AI领域论文、资讯、招聘、招博、开源代码, 一站式干货,每日2分钟刷完即赚!
👇扫码加入「龙哥读论文」知识星球,前沿干货、实用资源一站式拿捏~
龙哥推荐理由: 你以为给小白配一套代码、内存、比喻三管齐下的可视化工具,他们就会感恩戴德、学习效率飙升?多伦多大学用眼动追踪和深度访谈告诉你:真相恰恰相反。学生们宁可自己吭哧吭哧手动追踪代码,也不想让工具“替”他们思考,甚至觉得那些可爱的比喻图“太幼稚”不符合大学生身份。这篇ICER 2026的论文,撕开了工具设计的认知面纱,直抵学习者的心理与社会动机,给你一个重新审视编程教育工具设计的全新视角。
原论文信息如下:
代码是锚点,隐喻是支撑:学生如何处理多视图可视化?
想象一下,你是一个刚学编程的小白,面前摆着一个“神器”:左边是代码,中间是程序的内存状态,右边还有一个生动的比喻动画来解释程序在干什么。你会怎么用?
按常理,你肯定会到处看看,瞧瞧那些酷炫的动画,对吧?但是,多伦多大学的研究者们发现,现实远比想象的复杂得多。
他们设计了一个带有多视图的可视化工具,并招募了19名学完CS1和CS2的大学生,让他们一边用这个工具,一边大声说出想法,同时用摄像头追踪他们的目光。
这个工具叫多视图可视化工具,有三个同步的视图:代码视图、内存视图和比喻视图。比如,讲解作用域时,比喻视图会展示一个“房子”,每个作用域就是一个独立的房间,函数调用就像动画箭头在不同房间穿梭。讲解循环时,会用“魔术师的桌子”来揭示列表元素。讲解链表时,用接力赛来比喻节点的传递。是不是很贴心?
为什么学生盯着代码不放?——眼动追踪揭示的注意力分布
研究者用了WebGazer.js,一种基于摄像头的眼动追踪技术,来精确记录学生们看屏幕哪里。他们给多视图工具的三个窗格画了区域:代码、内存和比喻。
结果呢?学生们几乎一半的时间都盯着代码,就算旁边有内存和比喻的“辅助”也没用。
上图的左侧显示了学生们目光在不同窗格的停留时间,代码窗格“霸屏”了近一半的时间。右侧则展示了目光在不同区域之间切换的频率,可以看到代码果然是绝对的“C位”。
更有意思的是,那些上大学前没学过编程的学生,更“死磕”代码,对那个精心设计的比喻视图几乎视而不见。而那些有经验的同学,虽然也爱看代码,但会时不时瞥一眼内存视图。不管有没有经验,比喻视图的注视度都最低。
研究者原以为精心设计的视觉工具能引导学生,但没想到学生却死守着代码这块“根据地”。这让人不禁想问:“为啥你就不看看这些好用的工具呢?”
学生为何拒绝“好用”的视觉工具?——主动性、契合度与正当性三重因素
为了回答这个问题,研究者们深入分析了访谈记录,总结出三个主要因素:主动性 、契合度 和正当性 。
你可能会觉得,工具不就是来“减轻负担”的吗?但对于这些学生来说,这可能恰恰是他们不想要的东西。一位学生描述说:“我的思维过程是,我将会一步一步手动地追踪代码,看看它发生了什么。如果它自动(用比喻)做了,我会觉得我不需要去思考了,有点不舒服。” 他们想要的不是减少思考,而是掌控感 。自己手动追踪代码,虽然累,但是能让他们感觉自己在思考,是自己理解了,而不是被工具“灌”进脑子里的。
这是典型的主动认知加工 需求。学生不希望自己的认知努力被替代,他们渴望这种费力的过程,因为这是他们学习的一部分。
同样是这个工具,有人觉得它是“神助攻”,有人却觉得是“猪队友”。有的学生觉得比喻视图非常直观,一句“它确实在脑海中创造了一个画面,让我更容易理解啊”;但另一位同学却表示“当代码变得复杂时,比喻视图反而让我更迷惑,因为我不知道它想表达什么”。
这就解释了为什么代表性契合 很重要:一个设计再好的工具,也不能适应所有学生。信息太多了,你忙着理解比喻,可能就没空去理解代码本身了。
最扎心的理由来了。很多学生觉得那些生动形象的比喻,比如“房子”、“接力赛”,不够“上档次”。一位同学直言不讳地说:“我觉得它(比喻视图)有点幼稚……不适合大学水平。” 他们认为自己已经过了需要这种“幼稚”提示的阶段,使用它们会有失身份。
视觉工具设计的启示:如何让学生“主动参与”而不是“被动观看”?
既然知道了学生“不爱看”的原因,那么怎么解决呢?研究给设计工具的人提了几个实用的建议。
1. 把可视化定位成“验证工具”,而不是“解释指南”
与其一上来就用比喻视图“拆解”程序,不如让学生在凭自己努力理解后,用可视化来校验自己的思路。“哦,我猜对了,第一步之后变量x的值就是5!”这种“校验”的方式,把主动权又还给了学生,让他们可以保持学习的掌控感。
学生认知水平不同,需求也不同。可以提供一个按钮,让学生自己决定要看多深入。比如,刚开始学,可以看看比喻视图;后来熟练了,就可以切换到更抽象的内存视图,甚至只看代码。这样既照顾了初学者,也让有经验的学生不会觉得被“幼稚化”。
为了避免学生觉得工具“幼稚”,可以给它起个更正式的名字,或者在UI设计上采用更简约、专业的风格。甚至可以在课程初期就把它当作一个“严肃”的工具来介绍,而不是作为“趣味”辅助。让学生从心理上接纳它。
总结与展望:关注情感与社会因素,超越认知设计
这篇论文的意义在于,它揭示了一个常常被忽视的事实:工具设计不只是个技术活,还是个心理学和社会学活 。我们以前总想着怎么优化认知负荷,怎么设计“对”的表示,但这些研究基本都假设学生是“理性”的,只要工具好,他们就会用。
但真实情况是,学生有自主意识,他们想要掌控感;他们有不同的认知偏好,对“好”的定义千差万别;他们还有社会身份认同,会判断工具是否“配得上”自己。这些情感和社会因素,才是决定一个工具能不能“火”的关键。
未来,这项研究可以扩展到更大的样本、更长的使用周期,看看这些发现是否能持久。还可以对比不同设计策略的效果,比如试试把工具定位成“验证工具”是不是真的有奇效。最重要的是,把学生的声音纳入到工具的设计迭代中,而不是我们关起门来瞎猜。
总而言之,这篇来自多伦多大学、发表在ICER 2026上的论文,给所有编程教育工具有一记警钟:别光顾着画图,也看看你画的图到底有没有人看,为什么看。用户的“心”,可比你的“代码”复杂多了。
龙迷三问
Q1:这篇论文解决了什么问题? A1:这篇论文不是要提出一个更好的可视化工具,而是要回答一个更根本的问题:为什么已有的、认知设计上看起来很合理的可视化工具,学生在实际使用中却不愿意用?它通过实验和访谈,探究了影响学生与可视化工具互动的情感和社会因素,而不仅仅是认知因素。
Q2:什么是“多视图可视化工具”(Multi-Representational Tool, MR)?它是怎么工作的? A2:MR工具是本文中研究者设计的一个实验性工具,它有三个同步显示的面板:代码视图、内存视图和比喻视图。它的工作方式是,当用户点击“下一步”按钮时,代码会高亮当前执行行,内存视图会展示变量和对象的状态,比喻视图会用生动的动画来比喻程序的运行过程(比如用“房子”来比喻作用域)。这三种视图同步更新,旨在帮助学生从不同角度理解程序。
Q3:文中提到的“主动性”、“契合度”和“正当性”具体指什么? A3:这三个概念是本文分析学生为何拒绝工具的核心发现。主动性 指学生希望在学习过程中保持掌控感,自己动手追踪代码,而不是被工具替代思考。契合度 指同一个工具对不同学生的学习方式可能带来截然不同的效果,有人觉得有用,有人觉得是负担。正当性 指学生会对工具是否符合其大学生身份进行“社会性”判断,如果感觉工具“幼稚”,就会拒绝使用。
如果你还有哪些想要了解的,欢迎在评论区留言或者讨论~
龙哥点评
论文创新性分数: ★★★★✰
该研究的核心贡献不在于提出了一个全新的算法或模型,而是从心理和社会学视角审视了已有的程序可视化工具,提出了“主动性”、“契合度”和“正当性”三个新框架。在传统的“认知设计”主导的领域里,这一视角创新非常突出,直击痛点。
实验合理度: ★★★✰✰
采用了眼动追踪、有声思维和深度访谈结合的混合方法,设计严谨。但样本量仅19人,且实验时间较短,缺乏长期跟踪。这影响了结论的普适性,但作为定性研究,其揭示的深度和机制是值得肯定的。
学术研究价值: ★★★★★
这篇论文的研究价值很高。它为本领域的后续研究打开了一个新方向:从关注“怎么设计好工具”到“为什么好工具没人用”。提出的三个主题为后续研究提供了可操作的理论起点,对HCI和计算机教育研究都有启发意义。
稳定性: ★★★✰✰
论文本身并未提出一个稳定的产品,只是提出了一个实验性的研究工具。其结论的稳定性依赖于后续更大规模、更长周期的验证研究,目前只算是有趣的观察和假设。
适应性以及泛化能力: ★★✰✰✰
研究只针对多伦多大学的计算机专业二年级学生,样本的文化背景、学习环境都比较单一。结论是否能推广到其他地域、其他专业、其他教育水平的学生,还有待验证,目前适应性较低。
硬件需求及成本: ★★★★✰
这项研究本身不需要特别的硬件,数据收集主要依赖在线工具和摄像头(利用WebGazer.js)。成本主要在研究设计与访谈分析上,对硬件依赖极低。
复现难度: ★★★★✰
论文详细描述了实验的流程和访谈协议,数据和分析代码也已在OSF上开源,复现难度不高。但定性分析的解读具有一定主观性,完全复现其发现可能比较困难。
产品化成熟度: ★★✰✰✰
这篇论文的研究成果是设计原则和理论框架,而不是一个可以直接部署的产品。要将其转化为可落地的工具,还需要大量的设计、开发和用户测试工作。
可能的问题: 这本质上是一篇定性研究论文,样本小、周期短,结论虽有洞察却不够“硬”。提出的“主动性”“契合度”“正当性”等框架有些宏观,缺少量化的验证方法。另外,研究中使用的Python Tutor其实也不是严格意义上的“单视图”对比工具,对比的严谨性可以再提升。
主要参考文献
[1] Sibia, N., Wen, J., Richardson, A., et al. (2026). Code as Anchor, Memory and Metaphor as Support: Learner Experiences with Multi-View Visualizations. In Proceedings of the ACM Conference on International Computing Education Research (ICER '26).
[2] Ainsworth, S. (1999). The functions of multiple representations. Computers & Education, 33(2-3), 131-152.
[3] Guo, P. J. (2013). Online Python Tutor: Embedding the teaching and learning of programming with program visualization. ACM Transactions on Computing Education, 13(1), 1-24.
[4] Hundhausen, C. D., Douglas, S. A., & Stasko, J. T. (2002). A meta-study of algorithm visualization effectiveness. Journal of Visual Languages & Computing, 13(3), 259-290.
*本文仅代表个人理解及观点,不构成任何论文审核或者项目落地推荐意见,具体以相关组织评审结果为准。欢迎就论文内容交流探讨,理性发言哦~ 想了解更多原文细节的小伙伴,可以点击 "阅读原文", 查看更多原论文细节哦!
欢迎加入龙哥读论文粉丝群,和更多朋友一起探讨编程教育背后的心理学与社会学底层逻辑。
扫描下方二维码或者添加龙哥助手微信号加群 :kangjinlonghelper。
一定要备注:研究方向+地点+学校/公司+昵称(如 教育技术+上海+多伦多大学+龙哥) ,根据格式备注,可更快被通过且邀请进群。