
OpenAI 发布 MentalHealthBench:心理健康场景需要什么样的 AI 评测
OpenAI 推出 MentalHealthBench,一个由专家参与构建的基准,用于评估 AI 在真实心理健康对话中是否既有帮助又足够安全。
论文、技术突破与趋势解读

OpenAI 推出 MentalHealthBench,一个由专家参与构建的基准,用于评估 AI 在真实心理健康对话中是否既有帮助又足够安全。

希腊总理米佐塔基斯在贸易访问中罕见坦承,没有政府为AI即将带来的冲击做好准备。这一表态折射出全球AI治理的普遍困境:技术演进速度远超政策响应能力。

特朗普表示美国今后将把人工智能称为“超级智能”,这一表态虽无实质技术内容,却折射出 AI 话语权正被政治化,值得关注其对监管与行业叙事的潜在影响。

OpenAI 宣布成立独立数学家小组,为 AI 公司与数学研究界的互动提供建议。此前一系列“惊艳数学成果”引发争议,这次咨询被视为一次声誉修补。

OpenAI 与 Grab 推出 GO Forward with AI 区域项目,计划帮助东南亚 3 万名合作伙伴掌握实用 AI 技能,这是 OpenAI 在新兴市场落地能力建设的最新动作。

TechCrunch 创始人峰会将于 11 月 4 日在波士顿举行,议程围绕融资、招聘与 AI 洞察展开,定位是帮创业者少走弯路。

一篇在 Hacker News 引发讨论的文章提出反直觉观点:当前以“AI 安全”为名的监管与自我审查,可能正在削弱模型的实际安全性,而非增强它。

Anthropic 和 OpenAI 的新一代模型传递出相同信号:能力小幅提升,价格大幅下降。前沿 AI 竞争正从性能竞赛转向性价比比拼。

OpenAI 推出两款低价模型 GPT-6 Sol 和 Luna,以半价提供前代性能,意在压制 Anthropic 的高价产品;但独立分析显示实际智能提升有限,且 Anthropic 同期发布 Opus 5.5 打乱了节奏。

高通发布两款新手机芯片,强调AI能力,并称新旗舰可在本地运行300亿参数的混合专家模型。端侧大模型的门槛正在被重新定义。

微软宣布瓦解名为EvilTokens的AI辅助钓鱼平台,该平台提供端到端的批量账户劫持能力,已导致约1.2万个账户被攻陷。这一事件揭示网络犯罪正从手工攻击转向平台化、自动化运作。

加拿大不列颠哥伦比亚省就Tumbler Ridge枪击事件起诉OpenAI,要求其提供涉事枪手的ChatGPT对话日志,并承担新建学校的费用。这是地方政府首次把AI平台责任与具体暴力事件直接挂钩的诉讼之一。