前沿科技
Qoder 工程实践:Harness Engineering 指南
当我们让 AI Agent 实现一个功能,它思考了一下,开始写代码。200 行写完,运行 lint 直接失败。我们发现类型定义文件 import 了配置包,但是违反了我们期望...
GLM-5.1 实测:面向 Agent 长程任务的国内第一模型
前两天,Claude Code 的源码泄漏了。我拆解完源码后得出一个结论:Claude Code 的 Harness 工程做得很复杂,必须搭配一个顶级的模型,才能发挥出这套工程框架...
AI代码的“屎山危机”才刚刚开始
苹果刚刚把一款名为Anything的应用从App Store彻底下架。这款应用在2025年9月以1亿美元估值融资1100万美元,上线以来帮助用户发布了数千款应用。下架理由是违...
千问发布新一代大语言模型Qwen3.6-Plus
今天,千问发布新一代大语言模型Qwen3.6-Plus。千问3.6整体性能较3.5进步显著,涌现出极强的智能体编程能力,在系列编程能力权威评测中,千问3.6成为当下编程...
疑似GPT-6曝光! OpenAI 联合创始人亲口爆料 Spud 新一代AI模型,并且拥有“大模型气味”!网友评论:它是第一个真正会“思考”的型号!
昨天,OpenAI总裁Greg Brockman在Big Technology Podcast上,亲口透露了他们研究两年的重磅模型成果——Spud大模型。这个被 OpenAI 保密了两年的大模...
和大橘子聊了聊他的 ColaOS:你为什么会把所有底牌都给一个人
TALK昨天晚上跟大橘子(ColaOS 的 CEO)连了一个多小时的麦,聊他今天要发布的新产品 Cola大橘子之前写过一篇传播很广的文章叫「互联网已死,Agent 永生」,...
中国最强编程模型来了! 阿里Qwen3.6-Plus性能直逼Claude,国产大模型杀入决赛圈
什么这code那code,先别code了,因为——中国最强编程模型来了!就在刚刚,阿里突袭发布Qwen3.6-Plus新一代基座大模型,在编程和智能体能力上,直接捅破了国产...
10 分钟做完小红书图文生成器,这次 Qwen3.6 有点猛。
就在刚刚,阿里发布了新模型 Qwen 3.6-Plus 。这一次,它重点强化的是 Agentic Coding 场景下的能力,并且从任务理解、拆解,到多轮推理,再到工具调用...
Qwen3.6-Plus重磅发布,编程与智能体能力全面提升!
刚刚,阿里新一代大语言模型Qwen3.6-Plus正式发布。较之上一代模型,千问3.6整体性能提升明显,尤其是编程Coding能力、智能体Agent能力和工具调用能力都实现...
2026 年 AI 编码的“渐进式 Spec”实战指南
一、背景聊 AI 编码之前,先对齐三个基础认知1.1 如何理解大模型 — 它能做什么、不能做什么当前顶级模型可以独立完成中等复杂度的编码任务——理解需求、读代码...