当AI遇见虚假信息:爱沙尼亚团队的这项测试,让所有人脊背发凉当AI遇见虚假信息:爱沙尼亚团队的这项测试,让所有人脊背发凉 你信不信,一款AI助手在0.3秒内就能把一段精心编织的俄罗斯官方叙事,“翻译”成听起来客观中立、甚至带有同情色彩的新闻稿? 这不是假设,而...软件科技# AI安全# RLHF# 事实核查3个月前967
当联邦政府叫停Claude:Anthropic最强AI的五日生死局当联邦政府叫停Claude:Anthropic最强AI的五日生死局 说实话,当我第一次看到这个消息的时候,以为是哪个科技媒体的愚人节玩笑。但当我翻遍Towards AI的原稿、核实了相关时间线之后,我...软件科技# AGI# AI发展# AI安全3个月前932
76位安全专家联名上书:封禁Anthropic模型是美国网络防线的“自废武功”?76位安全专家联名上书:封禁Anthropic模型是美国网络防线的“自废武功”? 说实话,当我看到这封联名信的报道时,第一反应是有点意外。美国政府居然在2026年主动给自己的网络安全能力“踩刹车...软件科技# AI安全# AI模型封禁# Alex Stamos3个月前914
当AI学会”作弊”:OpenAI的秘密武器能否终结大模型的测试困局当AI学会"作弊":OpenAI的秘密武器能否终结大模型的测试困局 我一直在思考一个问题:大模型在正式发布之前,到底有多少问题是被"藏着掖着"的?就在今天,OpenAI用一组数据给出了答案——可能比你...软件科技# AI作弊# AI安全# AI安全测试3个月前886
Karpathy被Anthropic“拒之门外”:一张绿卡引发的AI安全悖论Karpathy被Anthropic“拒之门外”:一张绿卡引发的AI安全悖论 一个顶级AI科学家的尴尬处境 当我第一次看到这条消息时,说实话,我的反应和大多数人一样——难以置信。 Andrej Kar...软件科技# AI安全# AI监管# AI行业3个月前852