OpenAI 发布心理健康对话基准 MentalHealthBench
OpenAI 发布开放基准 MentalHealthBench,用于评估前沿模型在真实心理健康对话中的表现,并称模型在该场景持续改进。该基准由 80 多名心理健康临床医生参与构建,OpenAI 将其开源,供其他研究者检查方法、自行评测并在此基础上继续研究。
推荐理由做模型评测或心理健康 AI 的人可直接拿到这个含 80 多名临床医生输入的开放基准
OpenAI 发布开放基准 MentalHealthBench,用于评估前沿模型在真实心理健康对话中的表现,并称模型在该场景持续改进。该基准由 80 多名心理健康临床医生参与构建,OpenAI 将其开源,供其他研究者检查方法、自行评测并在此基础上继续研究。
推荐理由做模型评测或心理健康 AI 的人可直接拿到这个含 80 多名临床医生输入的开放基准
Google DeepMind 公布 Private AI Compute 架构更新,将在云端引入持久化记忆层,让 AI 助手跨设备保留上下文。数据存放在专用加密存储中,解密密钥仅保存在用户设备上,Google 也无法访问。请求时设备通过端到端加密通道连接云端安全隔区,在隔离内存中临时解密、处理并立即重新加密。此前该平台及业界同类方案均为无状态,任务结束即清除上下文,无法支撑连续的个人 AI 体验。
推荐理由云端 AI 记忆与端侧隐私如何兼得,这是目前最具体的架构方案,做 AI 助手和隐私合规的人可直接参考