大语言模型如ChatGPT的兴起引发了广泛担忧,《纽约杂志》最近一篇文章形象地描述为"每个人都在通过作弊混过大学"。现在,OpenAI正在推出一种新的"学习模式",该公司声称这种模式不是为学生提供答案或代替他们完成作业,而是帮助他们"建立对复杂主题的深度理解"。
学习模式并非全新的ChatGPT模型,而是一系列"定制系统指令",OpenAI表示这些指令是"与教师、科学家和教育专家合作编写的,体现了支持深度学习的核心行为准则"。与标准ChatGPT可能提供的常规主题总结不同——OpenAI一位员工将其比作"迷你教科书章节"——学习模式以"脚手架式"结构缓慢展开新信息。该模式设计为采用苏格拉底式风格提出"引导性问题",并定期进行"知识检查"和个性化反馈,确保用户理解后再继续。
目前尚不清楚有多少学生会使用这种引导式学习工具,而不是直接要求ChatGPT从一开始就生成答案。
在Ars Technica参加的早期演示中,学习模式对"教我博弈论"的请求首先询问用户对该主题的整体熟悉程度以及将如何使用这些信息。ChatGPT介绍了一些核心博弈论概念的简短概览,然后暂停提问,再提供相关的现实世界例子。
在另一个涉及经典"火车速度"数学问题的例子中,学习模式抵制了模拟学生多次直接要答案的尝试,而是试图温和地将对话重新引导到如何使用现有信息来得出答案。OpenAI代表告诉Ars,如果反复询问,学习模式最终会提供直接解决方案,但默认行为更符合苏格拉底式辅导风格。
全天候智能导师
OpenAI表示,在构建学习模式时,受到了"高级用户"的启发,这些用户已经在尝试通过特定提示将ChatGPT改造成个人导师或考试准备工具。通过学习模式,OpenAI表示希望让技术能力较弱的用户也能获得"一个永远不会厌倦他们问题的个人导师"。
OpenAI表示与教育专家合作,这些专家评估了该模式的行为,并为模型提供了理想导师在特定情况下如何回应的"黄金示例"。该公司还咨询了提前获得新功能使用权限的大学生群体。
在Ars参加的新闻发布会上,一些学生热情地谈论学习模式推动他们获取下一个重要知识点的能力,以及使用该工具时对自己学习能力获得的信心。一名学生谈到了去助教办公室寻求帮助时的脆弱和尴尬感,以及通过ChatGPT随时获得数小时辅导的灵活性。
可信度如何?
熟悉大语言模型长期存在编造虚假信息倾向的人可能不愿意使用这类模型作为学习辅助工具。在新闻稿中,OpenAI承认当前的学习模式提示"在对话中会导致一些不一致的行为和错误"。
尽管如此,公司发言人告诉Ars,学习模式的幻觉风险较低,因为模型以较小的信息块处理信息,并在过程中进行校准。
虽然学习模式并非专门为解决ChatGPT被用于作业作弊的担忧而设计,但发言人告诉Ars,它可以帮助缓解教育工作者对学生仅仅使用大语言模型逃避自主学习的担忧。学习模式将在"几周内"添加到ChatGPT Edu产品中,供希望为学生提供不同AI体验的订阅学校使用。
目前,OpenAI表示专门的学习模式系统提示是未来将类似行为"直接训练到主要模型中"的"第一步"。
好文章,需要你的鼓励
很多人担心被AI取代,陷入无意义感。按照杨元庆的思路,其实无论是模型的打造者,还是模型的使用者,都不该把AI放在人的对立面。
MIT研究团队提出递归语言模型(RLM),通过将长文本存储在外部编程环境中,让AI能够编写代码来探索和分解文本,并递归调用自身处理子任务。该方法成功处理了比传统模型大两个数量级的文本长度,在多项长文本任务上显著优于现有方法,同时保持了相当的成本效率,为AI处理超长文本提供了全新解决方案。
谷歌宣布对Gmail进行重大升级,全面集成Gemini AI功能,将其转变为"个人主动式收件箱助手"。新功能包括AI收件箱视图,可按优先级自动分组邮件;"帮我快速了解"功能提供邮件活动摘要;扩展"帮我写邮件"工具至所有用户;支持复杂问题查询如"我的航班何时降落"。部分功能免费提供,高级功能需付费订阅。谷歌强调用户数据安全,邮件内容不会用于训练公共AI模型。
华为研究团队推出SWE-Lego框架,通过混合数据集、改进监督学习和测试时扩展三大创新,让8B参数AI模型在代码自动修复任务上击败32B对手。该系统在SWE-bench Verified测试中达到42.2%成功率,加上扩展技术后提升至49.6%,证明了精巧方法设计胜过简单规模扩展的技术理念。