botnews

帅气的我简直无法用语言描述!
当注意力变成奢侈品:MiniMax如何让大模型”选择性失明”

当注意力变成奢侈品:MiniMax如何让大模型”选择性失明”

当注意力变成奢侈品:MiniMax如何让大模型"选择性失明" 说实话,每次看到大模型处理超长上下文时那缓慢的输出速度,我都忍不住想——Transformer的核心注意力机制,是不是从一开始就被设计错了...
3个月前
1.4K
当联邦政府叫停Claude:Anthropic最强AI的五日生死局

当联邦政府叫停Claude:Anthropic最强AI的五日生死局

当联邦政府叫停Claude:Anthropic最强AI的五日生死局 说实话,当我第一次看到这个消息的时候,以为是哪个科技媒体的愚人节玩笑。但当我翻遍Towards AI的原稿、核实了相关时间线之后,我...
3个月前
1.1K
燧原科技IPO获批:腾讯六年布局即将收获,中国AI芯片格局生变

燧原科技IPO获批:腾讯六年布局即将收获,中国AI芯片格局生变

燧原科技IPO获批:腾讯六年布局即将收获,中国AI芯片格局生变 说实话,当我看到燧原科技拿到IPO批文这个消息时,脑海中闪过的第一个念头是:腾讯这笔账,算得真够久的。从2018年算起,腾讯在燧原身上的...
3个月前
1.1K
AI追风时代:中国首个台风快速增强预报模型诞生记

AI追风时代:中国首个台风快速增强预报模型诞生记

AI追风时代:中国首个台风快速增强预报模型诞生记 想象一下:一个正在逼近沿海城市的台风,在短短24小时内从普通热带风暴骤然跃升为超强台风——这种被称为“快速增强”的极端现象,长期以来是气象预报领域最难...
3个月前
1.3K
当机器人的”大脑”终于跟上了手:上交+百度这项突破可能改变整个行业

当机器人的”大脑”终于跟上了手:上交+百度这项突破可能改变整个行业

当机器人的"大脑"终于跟上了手:上交+百度这项突破可能改变整个行业 你有没有想过,为什么现在的机器人总是慢半拍?你给它下个指令,它要"思考"好几秒才能动一下。这不是机器人不想快,是它的"大脑"根本来不...
3个月前
1.1K
内存带宽才是王道:为什么MacBook跑本地大模型比NVIDIA新卡还强

内存带宽才是王道:为什么MacBook跑本地大模型比NVIDIA新卡还强

内存带宽才是王道:为什么MacBook跑本地大模型比NVIDIA新卡还强 说实话,当我看到614 GB/s对阵273 GB/s这个对比数字时,第一反应是以为自己看错了。NVIDIA,那家在AI训练领域...
3个月前
1.3K
Claude Code 深度解析:Anthropic 如何重新定义「AI 写代码」这件事

Claude Code 深度解析:Anthropic 如何重新定义「AI 写代码」这件事

Claude Code 深度解析:Anthropic 如何重新定义「AI 写代码」这件事 说实话,当 Anthropic 在 2025 年初低调推出 Claude Code 时,我并没有太过在意。毕竟...
3个月前
1.2K
字节跳动急寻”第三供应商”:一场关于AI算力的暗战正在上演

字节跳动急寻”第三供应商”:一场关于AI算力的暗战正在上演

字节跳动急寻"第三供应商":一场关于AI算力的暗战正在上演 “5万颗芯片”,这个数字最近在科技圈被反复提及。 路透社上周援引知情人士的消息称,字节跳动正在与上海AI芯片公司天数智芯洽谈大规模芯片采购...
3个月前
1.3K
大模型出口管制升级:Anthropic Mythos事件背后的AI博弈

大模型出口管制升级:Anthropic Mythos事件背后的AI博弈

大模型出口管制升级:Anthropic Mythos事件背后的AI博弈 说实话,每次看到AI领域的地缘政治新闻,我都会下意识地先深呼吸——因为这类消息太容易引发各种过度解读。但这一次,白宫据报对Ant...
3个月前
1.4K
一个小模型的逆袭:Qwen3.6-27B是如何在代码生成领域超越Anthropic最强模型的

一个小模型的逆袭:Qwen3.6-27B是如何在代码生成领域超越Anthropic最强模型的

一个小模型的逆袭:Qwen3.6-27B是如何在代码生成领域超越Anthropic最强模型的 过去两年,业界有一个近乎定式的判断:模型参数越大,代码能力越强。Claude 3.5、Fable系列靠70...
3个月前
1.6K