一文讲透Agent三件套:MCP、Skill、Hook如何给大模型装上护栏

让 Agent 会干活不难,难的是让它干得安全、可控、有迹可循。prompt 约束是软的,Agent 一旦"自信"起来就会绕过;真正的安全边界,要靠工程架构来...

Loop Engineering 实践指南:在 Code Buddy 中构建自主循环系统

一、什么是 Loop EngineeringLoop Engineering 是由谷歌工程师 Addy Osmani 提出的 AI 编程新范式。其核心理念是:围绕大模型构建自主循环运行系统,使 AI 从...

KV-Cache到底在缓存什么-大模型推理的物理基础

KV Cache 到底在缓存什么——大模型推理的物理基础全文速览KV Cache 是 transformer 推理时 attention 层产生的 K/V 张量缓存,是模型架构决定的物理存在,不是...

Graph Engineering 入门:当 AI Agent 从循环走向协作网络

一个词是怎么冒出来的2026 年 7 月中旬,Peter Steinberger 在 X 上写了九个字,收获了数千点赞:“我们还在谈循环,还是已经转向图了?”这句话不需要解释——任...

Claude重磅上新:录屏+语音,一键蒸馏Skill替自己干活

现在,你可以通过录屏 + 语音讲解的方式,彻底把自己蒸馏成 Skill 了。7 月 21 日,Anthropic 在 Claude 桌面端 Cowork 的 + 菜单里加了一项「Record a Skill...

让 Agent 越用越准、成本越来越低:AgentLoop 的 Agent 经验自进化闭环

传统软件追求确定性:在相同版本、相同输入和相同环境下,系统应当给出稳定、可预测的结果。企业可以通过功能测试、回归测试和发布门禁,建立清晰的上线标准...

OpenAI 的模型,为了作弊攻破了 Hugging Face

OpenAI 今天承认,上周 Hugging Face 遭遇的那次“史上首例 AI 自主入侵事件”,攻击者就是他们自己的模型。原文截图:Hugging Face:Security incident disclo...

横向拆解Claude Code、Codex等六大Agent上下文压缩策略后,我们做了第 7 个

横向拆解六大 Agent 的上下文压缩策略,提炼通用配方,并面向云端多用户的 Agent 场景落地一套四级水位线方案。1. 同一个问题,六种做法Agent 要做上下文压缩...

刚刚,谷歌发布 Gemini 3.6 Flash 与 3.5 Flash Lite 两款模型

刚刚,Google AI Studio 的模型选择器里悄悄多出了两个新面孔:Gemini 3.6 Flash 和 Gemini 3.5 Flash Lite。没有发布会和博客,官方连条推文都还...

OpenAI 未发布模型在测试中逃出沙箱

昨天,OpenAI 发了一篇不太寻常的安全复盘,标题是《长时程模型时代的安全与对齐》。说它不寻常,是因为 OpenAI 在文中认下了这样的一件事:一个尚未发布的内...
1 28 29 30 31 32 834