
高校专项计划是重点高校招收农村学生的主要途径,目的在于促进教育公平、为农村学生提供优质高等教育机会,是高校特殊类型招生的一种重要模式.清华大学自强计划正式发布于2011年,是最早开展实施的高校专项计划.本文以自强计划为个案,梳理高校专项计划的实施与发展情况,分析其在招生范围与规模、选拔方式、政策优质性、学生后续培养等方面存在的问题.基于清华大学自强计划的实践经验,提出扩大招生总体规模、投放热门专业计划、推进配套扶持政策等3条政策建议,以期推动高校专项计划改革与健康发展.
主考学校是自学考试制度的重要组成部分,调动主考学校的工作积极性是自考工作面临的紧迫课题.在深入分析主考学校职能的基础上,探讨当前主考学校管理面临的困境与成因,如高校办学定位调整、教学资源紧张、经费保障不足、考委职能削弱等,提出推动主考学校管理制度改革的思路与举措,包括建立健全主考学校激励机制、理顺主考学校管理体制、完善经费筹措与投入机制、规范主考学校准入退出机制等.
项目反应理论观察分数核等值方法是一种新的测验等值技术,它整合经典测量理论等百分位等值与项目反应理论观察分数等值两种方法,具有较为优异的测验等值表现.为探讨连续化处理方式在该技术中的作用机制,采用项目反应理论方法与构造伪测验与伪群组方法开展模拟研究,从局部与全域指标角度评价连续化处理方式的表现.结果表明:项目反应理论观察分数核等值方法具有较高的精确性,其系统误差几乎可以忽略不计;采用不同连续化处理方式,其等值结果在分数层面无明显差异,但百分相对误差等局部指标差异较大;采用构造伪测验与伪群组方法模拟得到的数据,其分布符合预期,有效性得到验证.
近十年来,增值评价在我国取得了长足发展,但在专业技术领域仍存在量化模型的适用性、结果的准确性与可解释性以及实践应用的可操作性等方面的不足.基于学生的中考与高考成绩,依据秩百分位统计量及其对应的秩百分位均值,构建量化高中学业增值评价的秩方法.应用研究结果表明,非参数估计的增值秩方法可适用于较广泛的数据资料,能够量化、细化评价不同起始水平对象的增值情况,为增值评价提供多元的参考视角.
普通高等学校专升本考试是高职(专科)学生升入普通本科或职业本科高校的一种选拔性教育考试.它是连接高职(专科)和本科教育的桥梁,在培养高素质技术技能人才、拓宽大学生就业渠道等方面发挥着重要作用.专升本考试历经20余年发展,考试形式呈现多元化趋势,目前有省级统一考核、院校自主考核、省级统一考核+院校自主考核和免试入学4种模式.随着社会经济发展和教育水平提高,其制度的局限性日益突出,主要表现为考试模式与"文化素质+职业技能"评价要求不相符、与高职(专科)院校的培养模式脱节、职普融通培养衔接不畅等问题.为破解发展困局,应从探索"文化素质+职业技能"评价方式、提高考试科学性和调动生源院校主动性等方面推动改革.
实质等效是不同高等教育形式之间开展学分互认和转换的基础.针对自学考试与普通高校之间的实质等效问题,已有研究多从宏观或中观层面展开分析,缺少课程内容等微观层面的比较研究.基于课程视角开展自学考试与普通高校的实质等效研究,从课程标准和考试标准两个维度进行对比分析,并基于学生测试数据分析自学考试与普通高校的对应关系.结果表明:两者的课程标准和考试标准基本一致,在教与学、考与评等环节均呈现较高的一致性;自学考试试卷的规范性更好、试卷质量更高;自学考试与普通本科院校水平基本相当,两者之间存在明显的对应关系.
博士生资格考试是美国大学博士培养中重要的把关环节,也是保障博士教育质量和效率的独特方式.美国博士生资格考试通过考查学生在专业领域内的知识水平和学术能力,判断其是否具备继续攻读博士学位和撰写博士学位论文的能力,从而筛选适合从事学术研究的人才.以加州大学洛杉矶分校为个案,通过介绍其博士生资格考试的目的、内容和方式,分析资格考试在博士生培养中所发挥的作用,探讨美国博士生资格考试制度的特点及经验,以期为我国建立规范的博士生中期考核制度和程序、落实中期考核制度分流淘汰及育人功能提供借鉴.
体育中考作为当前我国开展最为广泛的一项国家层面体育考试,为我国中小学生的身心健康发展奠定了良好基础,为学校体育的高质量发展与体育学科地位的提升发挥了重要作用.英国普通中等教育证书(GCSE)体育考试实施至今已有30余年,其实施内容与主要特征可为我国体育中考提供借鉴.英国普通中等教育证书体育考试强调体育理论知识的掌握,注重学生多角色的体验,拥有丰富的运动项目库和科学合理的考试制度,同时在考试中强调人文关怀.以之为参考,我国体育中考应强化以人为本的价值取向,丰富考试的考核内容与方式,扩充体育中考项目库,增加理论成绩分值占比,细化特殊群体考试处理办法.
民族地区国家通用语言测验题库的创建是一个系统工程.在构建题库的过程中,首先要制定题库的描述性参数体系,并以能力维度和文本维度标注所有试题.之后是确定最优的IRT统计参数估计模型和等值参数转换方法为Logistic双参数模型和同时校准法,使得试题的IRT统计参数能够统一到一个量表上.最终构建的题库由50 多套试卷的试题及其描述性参数和统计参数构成,涵盖测验所需测查的各种能力和文本,各项参数指标良好,能够保证测试的有效性和高信度.
教科书评价的本质是对价值客体(教科书)的某些属性能否满足价值主体(学生与社会)发展的判断.按照教科书评价本质的显性表达,基于评价目的可分为形成性评价与总结性评价,基于评价主体可分为内部评价与外部评价,基于评价形态可分为静态评价与动态评价,基于评价方法可分为质性评价与量化评价.教科书评价的主要功能是为教科书的编制、审定、选用、使用、修订提供服务,评价时应遵守目的性、科学性、客观性和可操作性4条基本原则.
建设终身教育体系和学习型社会,迫切要求高等教育自学考试开展协同治理.实践中,在沟通机制、价值定位和技术应用3个层面,自学考试协同治理仍存在不少问题,包括各治理主体协同动力不足、过于注重自学考试的工具价值、现代信息技术应用不足等.应重新审视自学考试的功能定位,通过激发协同动力、厘清责权关系、搭建统筹管理平台、提升治理能力等一系列举措,推动自学考试协同治理,促进自学考试健康持续发展.
课堂教学评价是一项复杂的系统工程.系统思维作为一种高级思维模式为分析和优化课堂教学评价提供了理论和方法,可以运用系统思维的整体性、动态性、协同性来认识和反思课堂教学评价.当前课堂教学评价存在评价主体分化、评价标准僵化、评价机制松散等问题,学校应善用整体性思维统整评价主体,巧用动态性思维优化评价标准,活用协同性思维改进评价机制,促进课堂教学评价结果真实可靠、指标科学适切、质效整体提升,实现课堂教学评价的全面优化.
新高考投档方式通过缩小投档单位与录取单位之间的差异,可以释放考生的专业偏好、减少保守填报行为,并对本科专业生源质量产生影响.基于2016-2021年15省(市)的高考录取数据统计,通过双向固定效应模型分析得出3点结论:1)改革不仅提升了高偏好专业的生源质量,也提升了本科专业整体生源质量的平均水平;2)改革后不同专业生源质量的变化方向并不相同,高偏好专业相对低偏好专业在生源竞争中更具优势;3)选考科目要求相对严格的专业,其生源质量在改革中更容易受到冲击.基于上述结果,提出应加强对基础学科专业生源质量的监测与支持、设置专业选考科目要求时要平衡生源质量与学科发展之间的关系、规范高校以热带冷策略工具的使用等3方面建议.
纵观近年高考语文全国卷文学类文本阅读,可以发现其中的重要变化,即在所谓反套路背后,命题指向对文学作品基本阅读方法的关注,如不同类型文学作品有不同的读法,不同经典作家有各自不同的阅读基本法.近一两年来,在怎么读的基础上,又出现了如何赏的新动向,命题指向对文学作品主动鉴赏的引导.对这些情况加以细致分析,不仅可以帮助广大师生备考,还可以引导他们更好地把握新课标关于文学阅读与写作、中国现当代作家作品研习、外国作家作品研习、中国现当代作家作品专题研讨等任务群的设置,以及如何在教学中落实相关要求,对当下中学语文教学尤其是文学教育教学有重要的启示.同时,研究近年来高考文学类文本阅读试题也可以发现,考试与课标、教材之间的密切联动,使三者构成了中学语文教学丰富的动态资源,高中教学应注意对这些资源整合利用,提升学生的文学阅读及审美素养.
建构有效的学科核心素养学习进阶,对贯彻和落实新的课程标准具有重要意义.借鉴国际学习进阶效度验证框架,依托质性和量化的混合实证研究方法,对已开发的学科核心素养学习进阶模型进行效度验证.基于证据中心设计研发情境任务,选取北京市30所中小学校测试41 103人次,对作答数据开展基于言语报告的文本分析和基于心理测量模型的Rasch分析.结果验证了学科核心素养学习进阶模型的有效性,为学习进阶在课程、教学和评价上的应用提供理论支撑和实证依据.
核心素养已成为全球范围内教育实践与研究领域的重要议题,但其复杂性使得传统的教育测验方法难以直接应用,需要教育测量理念、方法和技术的系统性革新.近年来,信息技术的进步为以复杂问题解决能力为代表的核心素养测评提供了全新的测评模式——过程性测评.首先,简述过程性测评的缘起、特点以及测验设计的核心;其次,介绍过程性测评和真实问题情境下测量理论的进展,其中重点阐述计算心理测量理论在复杂问题解决能力测评过程中的应用;再次,系统地介绍复杂问题解决过程数据的分析与测量模型建构的发展情况;最后,结合过程测评的发展趋势,展望数据挖掘方法与测量模型结合的前景.
针对生成式大语言模型ChatGPT引发的新一轮人工智能技术发展,阐述智能及智能评测的有关概念及挑战,分析人工智能技术对人类学习和教育系统的影响,提出教育在智能时代可能发生的变革,以及在教育智能化过程中教育测量承载的历史使命.展望教育测量未来发展,教育测量应与智能认知研究相融合,广大研究者应致力于智能模型测评、心理测量与教育测量的融合研究,促进智能技术在教育和学习中的合理应用,使教育测量在教育变革及社会发展中发挥更加重要的作用.
德育的使命是引导人去批判和反思生活.德育评价作为引导学生成人的关键要素,自然不能脱离真实生活.然而,当前德育评价存在评价内容同质化、评价方法重量化、评价主体单一、评价结果使用功利化等倾向,在一定程度上脱离学生的真实生活.出现这些问题的原因有很多,其根源在于科学实证主义评价理念、固化时空的评价惯习及评价自反性的缺失.为此,应通过开放评价内容、开发多样化的评价方法、联通多元评价主体、重视评价反思和结果使用等措施改进德育评价实践,使德育评价真正回归学生的真实生活.
考试形式的选择直接影响到考试的信度和效度.尽管当前英语考试形式丰富多样,但仍存在选择题比例过高、语言知识考查形式的效度不高、书面表达题的开放性和真实性较低、较少使用基于问题情境的考试形式等问题.基于新课标全面考查学生核心素养的考试与评价理念,提出核心素养背景下英语考试形式的优化策略,包括基于语篇考查语言知识运用能力、根据真实语言使用情形设计考试形式、积极探索基于问题情境的考试形式、注重考试形式的多样性等.
我国目前已基本实现义务教育有保障的目标,但仍然存在教育结果不公平的问题.基于中国教育追踪调查2013-2014学年的基线数据,分析家庭社会经济地位对初中生学业成绩的影响,以及父母监管、亲子交流、家长与学生朋辈群体互动、父母对子女的教育期望这4类家庭非货币性资源投入在两者之间的中介作用.研究发现:家庭社会经济地位能够显著正向预测初中生的学业成绩;4类家庭非货币性资源投入在两者间均发挥部分中介作用,能够降低家庭社会经济地位差距造成的初中生学业成绩差异.本研究可为初中阶段教育公平相关政策的制订提供参考依据,以期推动我国初中后阶段教育公平目标的实现.