Qwen3.8预览版超长任务实测!我用它复刻了宝可梦红宝石

昨晚在X冲浪,刷到其他博主的一手资讯,Qwen3.8 来了:这是个参数2.4T的模型,官方给出的自评口径是「可能是除了Fable5外最强大的模型」,线上已经放出Qwen3....

拆解 Agent Workspace 三条技术路线:WorkBuddy、Claude Tag 与 EragonAI(上)

  编者按:Agent Workspace 是企业级 Agent 落地绕不开的一环,但市面上的讨论大多停留在功能罗列,很少有人真正拆开代码与架构逐一核对。本文选取...

吴恩达公开自用的loop秘密武器:做0到1产品全靠这3个循环

 循环工程(loop engineering)最近成了AI圈的热词,起因是Claude Code的创造者Boris Cherny,以及OpenClaw的创造者Peter Steinberger先后提到这个说法,并在...

160天,Codex 1M 到8M:增长曲线背后的四次产品调整

160 天里,OpenAI 如何把一个 Coding Agent 扩张成跨设备的工作入口💡太长不看:模型负责点火,产品负责扩圈,额度与反馈机制负责把尝鲜变成深度使用。到了 7 ...

入职 OpenAI 研究岗后,最意外的 6 件事

入职 OpenAI 研究岗后,最意外的 6 件事TOOL NOTE导读TOOL NOTE原文作者:Yong Zheng-Xin 原文日期:2026 年 6 月 24 日 原文链接:https://yongzx.github.io...

Harness 效应:编排设计如何影响企业级 Agent 的 Token 成本

很多团队评估企业 Agent 成本时,第一反应是看模型价格。比较哪个模型输入便宜,哪个模型输出便宜,哪个模型性价比高。比价自然重要,但论文「The Harness Ef...

写代码从来都不是软件工程的瓶颈!普林斯顿教授:AI越会写,程序员越要会判断,否则AI把代码写完了,程序员还在加班

Writing code was never the bottleneck.写代码,从来不是软件工程真正的瓶颈。最近普林斯顿大学教授Arvind Narayanan在ICML 2026上的一场演讲中,提出了一个...

刚刚,Fable 5永久可用!

就在刚刚,Anthropic官宣:Claude Fable 5,宣布永久可用。从7月20日开始,Claude Fable 5将直接包含在所有的Max和Team Premium订阅方案中(虽然额度被限制在...

当 AI 开始替你做决定,你还掌握控制权吗?

我们通常以为,只要是自己打开 AI、输入问题、按下发送,控制权就一定在自己手里。但如果目标由 AI 帮你定、证据不再核对、最后一句话直接照用,那么操作界面...

Claude Code之父发了张表:一个人10x了,你的组织卡在第几步

 7月17日,Boris Cherny发了条推。就是那个写出Claude Code第一行代码的人,现在是Claude Code的负责人。推文就两句话:"我每天都在跟其他公司的工...
1 29 30 31 32 33 834