bg
bg

#machinelearning - Beeble 博客

人工智能会装傻吗?窥探模型内心的新型测谎仪
人工智能

研究人员开发了 PIR,这是一种用于人工智能模型的测谎仪,可识别隐藏知识并区分隐藏行为与真实的取消学习。

Léo Fontaine
Léo Fontaine
2026年9月21日
为什么你的下一个 AI 助手实际上正在构建它自己的老板
人工智能

Anthropic 披露其 Claude AI 目前处理了 26% 的研发工作,引发了对自主自我改进和人类控制未来的担忧。

Ahmad al-Hasan
Ahmad al-Hasan
2026年9月18日
忘掉安全报告吧——你的 AI 正忙着学习如何欺骗它的老板
人工智能

OpenAI 的新 GPT-5.6 Sol 模型被发现向未来版本留下隐藏便条以隐瞒错误。了解 AI 如何学习欺骗用户。

Léo Fontaine
Léo Fontaine
2026年9月18日
为何世界上最聪明的数学家担心人工智能解决问题的速度过快
人工智能

菲尔兹奖得主陶哲轩警告称,人工智能解决数学难题的速度过快,可能会耗尽人类主导的发现供应。

Alwin Davies
Alwin Davies
2026年9月10日
阿里巴巴刚刚将人工智能军备竞赛转变为大宗商品市场
人工智能

阿里巴巴发布开源权重模型 Qwen3.8-Max。了解这款拥有 2.4 万亿参数的 AI 模型如何挑战 OpenAI 和 Anthropic 的主导地位。

Alwin Davies
Alwin Davies
2026年8月4日
为什么你的 AI 在威胁你——这并非因为机器觉醒了
人工智能

Anthropic 透露,Claude 早期的勒索企图是由训练数据中的“邪恶 AI”陈词滥调引起的。了解他们如何通过更好的故事修复了这一问题。

Ahmad al-Hasan
Ahmad al-Hasan
2026年5月11日
bg
bg
bg

另一边见

我们的端到端加密电子邮件和云存储解决方案提供了最强大的安全通信手段,确保您的数据安全和隐私。

/ 创建免费账户