OpenAI这次不写代码了——六款工具集体杀入白领办公室OpenAI这次不写代码了——六款工具集体杀入白领办公室 凌晨两点,一份投资银行的并购尽调报告完成了初稿。不是实习生熬夜赶工,而是Codex在喝咖啡。 这不是科幻场景。2026年6月2日,OpenAI...软件科技# AI工具2026# AI职业影响# ChatGPT企业版3个月前982
特征工程里那个危险的谎言:为什么机器学习模型”数据越多越受伤”特征工程里那个危险的谎言:为什么机器学习模型"数据越多越受伤" 说实话,我第一次看到这个结论时,脑子里冒出的第一个想法是:这不对劲啊。 做机器学习这么多年,从导师到教科书,从各种技术博客到顶会论文,所...软件科技# AutoML# 伪相关# 信号与噪声3个月前980
Claude Opus 正在学会”自己干活”:五条实战经验让 AI 真正实现长时自主Claude Opus 正在学会"自己干活":五条实战经验让 AI 真正实现长时自主 你有没有过这种体验——早上给 AI 下了一个任务,出门办事,晚上回来发现它早就跑偏了,甚至中途卡死报错?说实话,这...软件科技# Agent编排# AI Agent# Anthropic3个月前980
当AI不再需要云端:Stanford团队用OpenJarvis撕开一道口子当AI不再需要云端:Stanford团队用OpenJarvis撕开一道口子 老实说,这几年我和很多科技圈的朋友聊起大模型,绕不开的一个词就是“焦虑”。不是技术焦虑,是数据主权焦虑、隐私焦虑、成本焦虑...软件科技# Agent框架# AI Agent# NPU3个月前979
76位安全专家联名上书:封禁Anthropic模型是美国网络防线的“自废武功”?76位安全专家联名上书:封禁Anthropic模型是美国网络防线的“自废武功”? 说实话,当我看到这封联名信的报道时,第一反应是有点意外。美国政府居然在2026年主动给自己的网络安全能力“踩刹车...软件科技# AI安全# AI模型封禁# Alex Stamos3个月前977
AI芯片暗战:Anthropic挖角OpenAI工程师背后的IPO冲刺AI芯片暗战:Anthropic挖角OpenAI工程师背后的IPO冲刺 当一家估值数百亿美元的AI明星企业,去挖另一家同样估值数百亿美元的竞争对手的工程师,你会怎么解读这场人事变动? 我的第一反应是...软件科技3个月前977
纽约举起禁令大棒:AI算力狂欢背后的能源困局纽约举起禁令大棒:AI算力狂欢背后的能源困局 当英伟达的GPU一卡难求、当ChatGPT月活用户突破十亿、当每一家科技巨头都在疯狂囤积算力的时候,纽约州议会做了一件让整个硅谷都坐不住的事——他们刚刚投...软件科技# AI基础设施# AI算力# 数据中心能耗3个月前977
当AI学会”作弊”:OpenAI的秘密武器能否终结大模型的测试困局当AI学会"作弊":OpenAI的秘密武器能否终结大模型的测试困局 我一直在思考一个问题:大模型在正式发布之前,到底有多少问题是被"藏着掖着"的?就在今天,OpenAI用一组数据给出了答案——可能比你...软件科技# AI作弊# AI安全# AI安全测试3个月前976
当AI智能体撞上“天花板”:GPT-5.5登顶背后,最难任务0%成功率意味着什么当AI智能体撞上“天花板”:GPT-5.5登顶背后,最难任务0%成功率意味着什么 说实话,看到这条新闻的时候,我愣了好几秒。 OpenAI研究员诺姆·布朗(Noam Brown)在社交平台上宣布:GP...软件科技# 0%成功率# AI天花板# AI智能体3个月前974
当简单打败复杂:AI记忆系统的“自我感动”该结束了当简单打败复杂:AI记忆系统的“自我感动”该结束了 说实话,看到这项研究结果的时候,我愣了好几秒。一项由持续学习领域顶尖研究者发布的基准测试,用数据告诉我们:过去这些年,我们可能在记忆系统上投入了大量...软件科技# AI记忆系统# CL-Bench# 上下文学习3个月前970
轨道数据中心:理想很丰满,现实很骨感轨道数据中心:理想很丰满,现实很骨感 黄仁勋在2026年的英伟达GTC大会上喊出了“太空计算,最后的疆界,已经到来”的口号。这句话听起来既浪漫又充满未来感,让不少科技爱好者热血沸腾。SpaceX、Go...软件科技# AI GPU# Blackwell GPU# SpaceX Starlink3个月前965
为什么”聪明”AI反而会输?AutoLab基准揭示了一个反直觉的真相为什么"聪明"AI反而会输?AutoLab基准揭示了一个反直觉的真相 你有没有遇到过这种情况:一个看似简单的编程任务,AI却反复卡在同一个地方,怎么也过不去? 我最近看到了一个挺有意思的研究,心里琢磨...软件科技# AI Agent# AI优化能力# AI反馈机制3个月前965