Google TPU十年磨一剑:五代训练超算的进化密码Google TPU十年磨一剑:五代训练超算的进化密码 从256到9216:一场关于规模的技术长征 说实话,每次看到芯片数量的增长数据,我都会忍不住重新确认一遍——不是因为数据有误,而是因为这个增幅实...软件科技# 3D torus# AI芯片# AI训练超算2个月前1.1K
当小模型学会了所有”常识”之后:大模型不可替代的东西到底是什么当小模型掌握了所有基础常识,大模型还有什么不可替代?本文从斯坦福Potts团队数据诱导资源竞争实验出发,揭示大模型与小模型的本质差异在于低频复杂能力的获取需要跨越参数规模门槛。以Claude Fabl...自媒体专栏# Claude Fable5# DeepSeek V4 Pro# DeepSeek V53个月前1.3K
当AI开始设计下一代AI:DeepMind描绘的超级智能路径图当AI开始设计下一代AI:DeepMind描绘的超级智能路径图 2024年12月,Google DeepMind悄悄发布了一篇论文,没有盛大的发布会,没有社交媒体上的病毒式传播,但这篇名为《从通用人工...软件科技# AGI# AI设计AI# ASI3个月前889
Transformer合著者转身:Sakana AI要用“自我进化”打破算力困局Transformer合著者转身:Sakana AI要用“自我进化”打破算力困局 2026年的AI赛场,跑在最前面的永远是那几张老面孔——OpenAI、Google、Anthropic。它们的故事里永...软件科技# AI创业# AI发展# AI安全3个月前1.1K
Meta AI 竞赛逻辑:数据、规模与一场迟到的大会对话Meta AI 竞赛逻辑:数据、规模与一场迟到的大会对话 说实话,每隔一段时间,硅谷就会有一场对话让我忍不住反复咀嚼。这次是 Alexandr Wang——对,就是 Scale AI 的那位 90 后...软件科技# AI军备竞赛# AI基础设施# Alexandr Wang3个月前871
AI的真正瓶颈,不是模型,是数据AI的真正瓶颈,不是模型,是数据 去年我参加了一场AI工程师的闭门交流会,会上一个做推荐系统的团队分享了他们的“惨痛经历”:花了大半年时间调优模型,AUC指标从0.82提到了0.85,用户体验却几乎没...软件科技# AI数据瓶颈# AI落地# FAISS3个月前931
从北大“黄金二代”到OpenAI:苏炜杰的AI新征程与一场静悄悄的人才迁徙从北大“黄金二代”到OpenAI:苏炜杰的AI新征程与一场静悄悄的人才迁徙 --- 2026年5月的最后一天,一则不起眼的社交媒体动态在科技圈悄然流传。北京大学数学科学学院2007级校友、沃顿商学院副...软件科技# AI人才# COPSS奖# OpenAI3个月前1.2K