OpenAI今日宣布计划为ChatGPT配备新的安全功能,使其能够在用户遭遇心理或情感困扰时做出更有帮助的响应。
首次即将推出的更新将专注于GPT-5的路由器组件,这是驱动ChatGPT的人工智能系统。路由器会分析每个用户提示,并自动确定OpenAI的哪个大语言模型最适合处理该请求。用户也可以手动指定应使用的大语言模型。
OpenAI将发布路由器的升级版本,该版本能够检测用户何时遭遇急性困扰,并将提示发送到推理优化的大语言模型。OpenAI员工在博客文章中写道,此类大语言模型比驱动ChatGPT的其他模型提供"更有帮助和有益的响应"。即使用户最初选择了较不先进的算法,路由器也会选择推理优化的大语言模型。
该公司计划"很快"发布升级版路由器。此外,它还将引入家长控制功能,旨在为青少年提供更强的内容保护。后者更新预计在下个月内推出。
家长将能够通过验证邮件将其ChatGPT账户与青少年的账户关联。从那里,家长将获得设置适合年龄的模型行为规则的能力,并禁用某些ChatGPT功能,如聊天历史记录。此外,OpenAI计划生成关于潜在有害提示的警报。
OpenAI解释说,ChatGPT将发送"当系统检测到他们的青少年处于急性困扰时刻的通知"。"专家意见将指导此功能,以支持家长和青少年之间的信任。"
OpenAI计划从由青少年发展、心理健康和人机交互专家组成的委员会获取专家意见。这家AI提供商今天表示,这些专家将帮助其开发ChatGPT家长控制功能的未来升级。
据OpenAI称,该委员会将与第二组专家合作,后者被称为全球医师网络。它包括250多名医疗专业人员,包括精神科医生、儿科医生和全科医生。OpenAI已经与这些医生在多个研究项目上合作。
"他们的意见直接影响我们的安全研究、模型训练和其他干预措施,帮助我们在需要时快速联系合适的专家,"OpenAI员工写道。"我们正在向我们的网络中添加更多临床医生和研究人员,包括那些在饮食失调、物质使用和青少年健康等领域具有深厚专业知识的人。"
今天宣布的举措是OpenAI上个月首次详述的更广泛AI安全推进的一部分。当时,这家大语言模型开发者表示,其研究人员还将使ChatGPT更好地检测长时间聊天会话中心理和情感困扰的迹象。此外,OpenAI将增强其用于阻止潜在有害提示响应的防护措施。
Q&A
Q1:OpenAI为ChatGPT新增的安全功能主要解决什么问题?
A:主要解决用户心理和情感困扰问题。新功能能够检测用户何时遭遇急性困扰,并自动将请求路由到推理优化的大语言模型,提供更有帮助和有益的响应,同时为青少年用户提供更强的内容保护。
Q2:ChatGPT的家长控制功能具体有哪些?
A:家长可以通过验证邮件将账户与青少年账户关联,设置适合年龄的模型行为规则,禁用聊天历史记录等功能,接收潜在有害提示的警报,以及当系统检测到青少年处于急性困扰时刻时收到通知。
Q3:OpenAI如何确保这些安全功能的专业性?
A:OpenAI建立了由青少年发展、心理健康和人机交互专家组成的委员会,以及包含250多名医疗专业人员的全球医师网络,包括精神科医生、儿科医生等,这些专家的意见直接影响安全研究和模型训练。
好文章,需要你的鼓励
火箭实验室(Rocket Lab)宣布计划以现金加股票方式,斥资80亿美元收购主要卫星运营商铱星通信(Iridium Communications),交易预计于2027年中完成。铱星目前运营着由66颗活跃低轨卫星组成的星座网络,拥有约255万活跃用户,2024年营收达8.717亿美元。收购完成后,Rocket Lab计划借助其新型重型运载火箭Neutron及Lightning卫星平台,扩大铱星星座规模,开拓未被覆盖的市场并降低发射成本。
谷歌研究院开发的论文助手工具PAT,利用分阶段深度推理流水线自动审查学术论文,在真实错误检测任务上达到89.7%召回率,并已在STOC和ICML两大顶会完成超4700篇论文的真实部署。
音乐流媒体平台Tidal宣布,将于7月中旬启用自动化工具,对完全由AI生成的音乐添加"AI"标识,并移除具有欺诈性质的曲目。平台还将取消AI生成音乐的版税资格,仅向真人创作、演唱的原创音乐开放变现渠道。此外,Tidal明确将高频异常上传、干扰真实艺术家等行为列为欺诈活动。Deezer、Spotify等竞争对手此前已推出类似检测机制,流媒体行业正加速构建AI内容治理体系。
香港大学与武汉大学联合开发的EO-WM系统,将地球观测卫星图像预测重新定义为天气驱动的世界建模问题,通过把气象信号拆解为气候基线、天气异常和累积压力三层,显著提升了对极端干旱和热浪事件下植被退化的预测准确性。