前沿科技

Qoder 工程实践:Harness Engineering 指南

当我们让 AI Agent 实现一个功能,它思考了一下,开始写代码。200 行写完,运行 lint 直接失败。我们发现类型定义文件 import 了配置包,但是违反了我们期望...

GLM-5.1 实测:面向 Agent 长程任务的国内第一模型

前两天,Claude Code 的源码泄漏了。我拆解完源码后得出一个结论:Claude Code 的 Harness 工程做得很复杂,必须搭配一个顶级的模型,才能发挥出这套工程框架...

AI代码的“屎山危机”才刚刚开始

苹果刚刚把一款名为Anything的应用从App Store彻底下架。这款应用在2025年9月以1亿美元估值融资1100万美元,上线以来帮助用户发布了数千款应用。下架理由是违...

千问发布新一代大语言模型Qwen3.6-Plus

今天,千问发布新一代大语言模型Qwen3.6-Plus。千问3.6整体性能较3.5进步显著,涌现出极强的智能体编程能力,在系列编程能力权威评测中,千问3.6成为当下编程...

疑似GPT-6曝光! OpenAI 联合创始人亲口爆料 Spud 新一代AI模型,并且拥有“大模型气味”!网友评论:它是第一个真正会“思考”的型号!

昨天,OpenAI总裁Greg Brockman在Big Technology Podcast上,亲口透露了他们研究两年的重磅模型成果——Spud大模型。这个被 OpenAI 保密了两年的大模...

和大橘子聊了聊他的 ColaOS:你为什么会把所有底牌都给一个人

TALK昨天晚上跟大橘子(ColaOS 的 CEO)连了一个多小时的麦,聊他今天要发布的新产品 Cola大橘子之前写过一篇传播很广的文章叫「互联网已死,Agent 永生」,...

中国最强编程模型来了! 阿里Qwen3.6-Plus性能直逼Claude,国产大模型杀入决赛圈

什么这code那code,先别code了,因为——中国最强编程模型来了!就在刚刚,阿里突袭发布Qwen3.6-Plus新一代基座大模型,在编程和智能体能力上,直接捅破了国产...

10 分钟做完小红书图文生成器,这次 Qwen3.6 有点猛。

就在刚刚,阿里发布了新模型 Qwen 3.6-Plus 。这一次,它重点强化的是 Agentic Coding 场景下的能力,并且从任务理解、拆解,到多轮推理,再到工具调用...

Qwen3.6-Plus重磅发布,编程与智能体能力全面提升!

刚刚,阿里新一代大语言模型Qwen3.6-Plus正式发布。较之上一代模型,千问3.6整体性能提升明显,尤其是编程Coding能力、智能体Agent能力和工具调用能力都实现...

2026 年 AI 编码的“渐进式 Spec”实战指南

一、背景聊 AI 编码之前,先对齐三个基础认知1.1 如何理解大模型 — 它能做什么、不能做什么当前顶级模型可以独立完成中等复杂度的编码任务——理解需求、读代码...
1 97 98 99 100 101 834