当AI Agent拿起命令行:一段关于隔离与风险的实验之旅当AI Agent拿起命令行:一段关于隔离与风险的实验之旅 "给大语言模型一个BashShell,就像把喷火器交给幼儿园小朋友——毫无用处,但令人胆战心惊。" 半年前,我在某个AI工程社区看到这句话时...软件科技# AI Agent# Bash Shell# Prompt injection3个月前911
Claude Opus 正在学会”自己干活”:五条实战经验让 AI 真正实现长时自主Claude Opus 正在学会"自己干活":五条实战经验让 AI 真正实现长时自主 你有没有过这种体验——早上给 AI 下了一个任务,出门办事,晚上回来发现它早就跑偏了,甚至中途卡死报错?说实话,这...软件科技# Agent编排# AI Agent# Anthropic3个月前901
我眼睁睁看着我的AI Agent在工具调用中途编瞎话——这比普通幻觉恐怖多了我眼睁睁看着我的AI Agent在工具调用中途编瞎话——这比普通幻觉恐怖多了 凌晨两点,我对着屏幕愣了足足三十秒。 事情的经过是这样的:我在测试一个基于大语言模型的智能体(Agent),给它发了一条再...软件科技# Agent架构# AI Agent# API响应3个月前898
为什么”聪明”AI反而会输?AutoLab基准揭示了一个反直觉的真相为什么"聪明"AI反而会输?AutoLab基准揭示了一个反直觉的真相 你有没有遇到过这种情况:一个看似简单的编程任务,AI却反复卡在同一个地方,怎么也过不去? 我最近看到了一个挺有意思的研究,心里琢磨...软件科技# AI Agent# AI优化能力# AI反馈机制3个月前892
当AI智能体开始”断舍离”:AdaCoM如何用上下文管理让长任务效率飙升39%当AI智能体开始"断舍离":AdaCoM如何用上下文管理让长任务效率飙升39% 被上下文淹没的智能体:AI Agent的阿喀琉斯之踵 我一直觉得,这两年AI Agent概念火得一塌糊涂,但真正用过的人...软件科技# AdaCoM# AI Agent# AI智能体3个月前870
微软给AI Agent套上缰绳:一套规范让开发者重新掌握控制权微软给AI Agent套上缰绳:一套规范让开发者重新掌握控制权 当一个AI Agent能够自主发送邮件、修改代码、甚至替你完成线上交易时,你真的知道自己让它做了什么吗? 这个问题正在成为企业AI落地最...软件科技# AI Agent# Azure AI# RBAC3个月前855
Google想用一招打通AI Native应用的”任督二脉”,但事情没那么简单Google想用一招打通AI Native应用的"任督二脉",但事情没那么简单 说实话,过去两年我写过不少关于AI Native应用开发的选题,但每次聊到“如何在AI应用里优雅地展示界面”这个问题,总...软件科技# AI Agent# AI Native应用# AI应用开发3个月前740