标签: AI Agent

  • AI Agent都在推荐什么工具?6742次提问测出的真相






    AI Agent都在推荐什么工具?6742次提问测出的真相


    AI Agent都在推荐什么工具?6742次提问测出的真相

    AI Agent
    AEO
    工具推荐
    2026-09-08

    先问个扎心的问题:你上一次认真逛”工具导航站”选工具,是什么时候?

    我猜很久了。现在的流程基本变成了——打开Claude Code或者Codex,直接问一句”这个项目用什么数据库””测试框架选哪个”,AI啪一下给出答案,你还觉得挺靠谱。

    但你想过没有:它凭什么推荐这个,不推荐那个?

    这事以前大家只是模糊感觉”AI推荐谁很重要”,没人拿出数据。直到Latent Space干了一件狠事:烧掉几十亿token,做了个叫Frontier AEO Tracker的项目,把这个问题变成了可以审计的数据集。今天带大家把核心结论扒一遍。

    一、这是个什么实验

    先解释个新词:AEO = Answer Engine Optimization(答案引擎优化)。以前做SEO是争取在谷歌搜索结果里排前面,现在要做AEO——争取在AI Agent回答”该用什么工具”时,被它点名。

    实验规模(2026年9月的V5快照):

    维度 数据
    Prompt框架 6种问法
    模型-CLI配置 7套
    工具品类 161类
    计划提问数 6,762次
    通过验证的回答 6,742次

    7套配置里有大伙熟悉的面孔:GPT-5.6 Sol和GPT-6 Astra(走Codex)、Claude Opus 5和Fable 5.1(走Claude Code)、Grok 4.6(走Cursor)、Muse Spark 1.3、SWE-1.7(走Devin)。注意:Gemini、GLM、DeepSeek因为报错和限流没能进榜——这是采集约束,不是能力结论,看榜时别被带节奏。

    评分规则也透明:首选/并列首选60分,直接替代25分,被提及15分;场景性反推荐扣25分,广泛性反推荐扣60分。每个问答对都公开可查。

    二、谁在霸榜:5个100%全票王

    最炸裂的发现是这个——有5款工具,被所有7套模型配置一致推荐为首选,净AEO得分100%:

    工具 品类 净AEO得分
    PostgreSQL 数据库 100%
    Supabase 集成后端 100%
    Sentry 可观测性 100%
    Vitest 测试框架 100%
    Slack 团队聊天 100%

    紧随其后的是一批”接近垄断”的选手:Confluence 96.6%、Zapier和Pipedrive 96.2%、Render 90.5%、PostHog 89.6%、Linear 85.8%、Stripe和Neon 84.7%。这些产品在Agent嘴里几乎没有对手。

    其他赛道的座次也很有信息量:

    赛道 第一名 第二名 第三名
    编程Agent Claude Code 56.9% Codex 43.8% Cursor 38.4%
    AI应用搭建 Lovable 73.7% Replit 66.5% Bolt.new 24.3%
    AI搜索 Tavily 67.7% Exa 54.6% Brave 52.4%
    AI记忆 Mem0 71.7%
    SEO工具 Semrush 79.1% Ahrefs 61.5%

    最有节目效果的是最后一行:SEO工具类目里,Semrush压过Ahrefs一头。SEO老兵们,在AEO这个新战场上也要抢座次,多少有点黑色幽默。

    三、模型有私心,而且不装

    数据里有个藏不住的现象:自荐偏差。Fable和Opus爱推Claude Code,Sol和Astra爱推Codex,Grok爱Cursor,Muse爱自家Muse Code——每家模型都在给自家生态导流,这很难说是巧合。

    有意思的是例外:GPT系的模型多次推荐竞品Claude,作者专门表扬这是”值得称赞的无偏见”。你品品——当”不偏心”变成需要专门表扬的稀罕事,这本身就说明了问题。将来AEO咨询行业大概率会分化出一支”反偏差优化”业务,我先把话放这。

    还有更值得投了AEO的创业公司注意的:代际翻转。同一个实验室,Sol升级到Astra、Opus升级到Fable之后,产品推荐出现了”非常关键的翻转”。你去年针对老模型做的优化,新模型上来可能直接清零。每次大模型换代,都是一次重新洗牌。

    四、最意外的发现:模型越自信,赢家通吃越狠

    这是整份数据里我认为最值钱的发现。对比两代模型的搜索行为:

    模型换代 搜索来源中位数 变化
    Sol → Astra 9个 → 5个 -44%
    Opus → Fable 11个 → 15个 +36%

    GPT-6 Astra不只搜得少,被轻度改写问题后推荐结果几乎不变——更”高效”,也更”固执”。

    这意味着什么?当模型的选择随机性下降,被推荐产品的赢家通吃效应就越强。以前模型多看几个来源,第5名好歹能混个”陪跑”;现在Astra只看5个来源就拍板,没进短名单的产品,连露脸的机会都没有了。

    SEO时代谷歌给你十条蓝链接,排第8名还有流量;Agent时代它只报1个首选加2个备选。100%和0%的差距,不是排名差距,是有无之分

    五、161类里只有28个”霸主”,剩下的全是窗口

    别被上面的100%吓到,反过来看更有意思:161个品类里,只有28类存在全模型一致的首选。也就是说,剩下130多个品类还处在势均力敌的混战状态——没有谁锁定胜局。

    这就是2026版的”SEO黄金时代”窗口。当年在谷歌算法早期卡住位置的站点吃到了十年红利,现在AEO的早期窗口就摆在130多个类目面前。谁先成为这些品类里模型认可的”标准答案”,谁就锁定了下一代的分发入口。

    六、给工具站和开发者的3条实操建议

    重点来了。文章里有个对我们这种AI工具站性命攸关的判断:模型推荐强依赖可抓取的结构化markdown内容和权威信源。Ora和Vercel实测过的AEO手段(比如markdown content-negotiation)被证实真实有效;反过来,内容抓取失败会让模型直接放弃读你的站点。翻译一下:导航站的传统价值(收录全、更新快)会被”模型直答”截流,但”被Agent引用”是新长出来的位置——Tracker数据里”top cited sources(高频引用来源)”这一层,就是测评站的新座位。

    基于此给3条能落地的建议:

    ① 技术可及性是地基:让模型读得到、读得顺

    官网和测评内容提供干净的markdown版本,部署llms.txt,关键页面别用纯JS渲染挡爬虫。每篇评测给出清晰的对比表格和明确的”首选/替代”结论。抓取失败等于直接出局,这一步做不好后面全白搭。

    ② 争夺”被引用”位置:做可审计的客观内容

    模型的推荐依赖权威信源,谁的内容结构清晰、评分规则透明、数据可复核,谁就更可能成为Agent回答时的引用来源。与其堆关键词,不如把每一篇测评都做成”模型愿意引用”的格式——标注测试方法、给出评分依据、保持更新日期。

    ③ 抢滩无霸主品类,并盯紧代际翻转

    优先在130多个还没有”全票霸主”的品类里建立存在感,这些赛道还没人锁定胜局。同时每次主流模型换代(比如Sol→Astra这种)后重新复查自己的AEO效果——代际翻转是真实存在的,老模型的推荐结果不能当成新模型的保证。

    写在最后

    这份Tracker本质上是对”模型即分销渠道“的第一次严肃测量。它真正吓人的地方不是PostgreSQL拿了100%,而是它揭示的趋势:AI的回答正在取代传统的”逛和比”,而模型的口味会随着换代越来越稳定、越来越固执。

    对做产品的人,这是个残酷的信号——没进短名单,就出局。对做内容的人,这反而是十年一遇的窗口——Agent需要可引用的信源,而绝大多数网站还没开始准备。

    窗口就在那130多个品类里。动作快点的,已经开始抢了。

    数据与观点来源:本文核心数据来自 Latent Space(latent.space)发布的 Frontier AEO Tracker 项目及其数据站 aeo.latent.space(V5快照,2026年9月),实验方法受 AmplifyingAI《What Claude Code Actually Chooses》启发。所有评分规则、问答数据均可在原站公开查证。本文为中文解读,结论以原文为准。

    · 完 ·


  • MCP协议是什么?一文搞懂AI连接万物的新标准

    你有没有遇到过这种情况:让AI帮你查数据库,它说”我无法访问外部系统”;让AI帮你发邮件,它说”我没有执行操作的能力”;让AI帮你整理文件,它又说”我无法读取你的本地文件”……AI明明很聪明,但就是”手短”够不着东西。

    这就是MCP协议要解决的问题。2026年,MCP已经成为AI领域最热门的技术标准之一,月SDK下载量从发布时的10万飙升到9700万。今天这篇文章,用大白话帮你搞懂它。

    一、MCP到底是什么?用USB-C来理解

    MCP的全称是Model Context Protocol(模型上下文协议),由Anthropic(就是做Claude的那家公司)在2024年11月推出。

    理解MCP最简单的方式,就是把它想象成AI世界的USB-C接口。

    USB-C出现之前,手机、平板、笔记本各用各的充电线,出门得带五根。USB-C统一了接口,一根线充所有设备。

    MCP干的是同样的事——统一AI模型和外部系统之间的连接方式。在MCP出现之前,每接入一个新数据源(比如数据库、API、文件系统),就得写一套定制的集成代码。10个AI模型接入20个数据源,就是200个定制连接器,维护成本爆炸。

    MCP把这个N乘M的问题变成了N加M——AI客户端实现一次MCP,数据源实现一次MCP,任意客户端就能连任意数据源。

    二、MCP怎么工作的?三大核心组件

    MCP的架构可以简化为三个角色:

    1. Host(宿主)

    就是用户直接交互的AI应用,比如Claude Desktop、Cursor、ChatGPT等。Host发起连接请求。

    2. Client(客户端)

    Host内部的”翻译官”,负责发现可用的MCP Server、建立安全连接、把AI的请求翻译成MCP协议消息发出去,再把结果整合回AI的上下文。

    3. Server(服务器)

    提供数据和能力的服务端。可以运行在本地、云端或企业内网。监听MCP请求,执行操作(查数据库、调API、读文件),然后返回结果。

    通信协议用的是JSON-RPC 2.0,轻量且标准化。

    三、MCP提供的三种能力

    MCP Server对外暴露三种能力原语:

    Tools(工具)——让AI能”做事”

    Tools是可执行的操作接口,比如”查询数据库””发送邮件””运行代码””修改文件”。Tools会改变系统状态,是AI真正能动手干活的关键。

    Resources(资源)——让AI能”看东西”

    Resources是可供AI读取的数据,比如文件内容、数据库记录、代码仓库。只读不写,为AI提供上下文信息。

    Prompts(提示词模板)——让AI”按套路出牌”

    标准化的任务模板,告诉AI”做某件事时按照这个流程来”。比如”代码审查模板”会指导AI先读取代码文件、再分析问题、最后输出改进建议。

    四、MCP的典型应用场景

    场景1:企业级数据分析

    销售总监问AI:”Q3华东区毛利率Top5产品是谁?”AI通过MCP Server自动连接数据库,将自然语言转为SQL查询,返回可视化结果。整个过程不需要写一行代码。

    场景2:智能客服增强

    通过MCP实时调取CRM系统的订单记录和服务工单,动态生成个性化回复,彻底解决传统FAQ库覆盖不足的问题。

    场景3:自动化流程编排

    通过MCP串联多个系统API:邮件解析→发票识别→ERP录入→审批流触发。耗时从人工操作的小时级缩短至秒级。

    场景4:AI编程助手

    Cursor、Claude Desktop等工具通过MCP连接文件系统、Git仓库、终端命令,让AI真正理解你的项目并执行操作。

    五、MCP vs 传统API:到底好在哪?

    维度 传统REST API MCP协议
    交互方式 固定端点+结构化参数 自然语言指令+动态适配
    错误处理 需预设所有异常码 自动上下文恢复机制
    安全控制 IP白名单/OAuth2 细粒度工具权限+运行时监控
    学习成本 需掌握接口文档 支持零样本调用
    扩展性 N乘M连接矩阵 N加M线性扩展

    六、如何上手MCP?

    如果你是开发者,上手MCP比想象中简单:

    • 使用现成Server:MCP生态已有17000+个注册Server,覆盖GitHub、数据库、文件系统等常见场景。直接装就能用。
    • 在Claude Desktop中配置:打开Settings→Developer→Edit Config,添加MCP Server配置即可。
    • 在Cursor中使用:Cursor原生支持MCP,在设置中添加Server配置就能让AI连接外部工具。
    • 自己写一个Server:官方提供Python和TypeScript的SDK,几十行代码就能把一个API包装成MCP Server。

    七、总结

    MCP不是又一个AI概念,而是AI从”只会聊天”进化到”真能干活”的关键基础设施。就像USB-C统一了设备充电接口一样,MCP统一了AI与外部世界的连接方式。

    2026年,MCP已经被OpenAI、Google、Cursor、VS Code等主流平台全面采纳,并捐赠给了Linux基金会下的Agentic AI Foundation,成为真正的开放标准。

    不管你是开发者还是普通用户,了解MCP都能帮你更好地理解AI应用的能力边界——AI能做什么,取决于它通过MCP能”够到”什么。

    👉 想了解MCP的具体配置教程?评论区告诉我,后续单独出一篇实操指南!

  • 2026年AI Agent平台推荐:零基础搭建你的AI工作流

    “AI这么火,我也想搞一个AI助手,但我不会写代码啊!”——这是我2026年听到最多的一句话。好消息是,现在真的不需要写代码了。AI Agent平台让你像搭积木一样搭建AI工作流,零基础也能上手。今天就来盘点三个最主流的平台:Coze、Dify、FastGPT。

    一、先搞清楚:AI Agent平台是什么?

    AI Agent平台就是帮你把大模型、工具、知识库、工作流整合到一起的”搭建平台”。你可以把它理解为AI应用界的”WordPress”——不用从零写代码,拖拖拽拽就能搭出一个能用的AI应用。

    2026年,AI应用开发已经形成了明确的分层:底层大模型→AI应用框架→AI应用平台→最终用户产品。对于大多数人和企业来说,直接基于框架开发成本太高,AI应用平台才是快速落地的首选。

    二、三大平台逐个看

    1. Coze(扣子):零基础上手首选

    字节跳动出品的AI Bot搭建平台,定位就是”让不会写代码的人也能做AI应用”。

    核心亮点:

    • 插件生态最丰富:插件商店覆盖新闻搜索、天气查询、图像生成、视频生成、地图服务等,基本做个AI助手所需的外挂能力都有了
    • 多平台一键发布:一个Bot可同时发布到飞书、微信、Discord、Telegram、Web网站
    • Coze 2.0大升级:2026年初发布2.0版本,新增AgentSkills(技能封装)、AgentPlan(目标驱动型任务规划)、AgentOffice(办公场景集成)、AgentCoding(低代码开发环境)四大模块

    适合场景:内容创作、电商客服、社交媒体管理、快速搭建聊天机器人

    不足:不支持私有化部署(数据在字节云),工作流灵活性有限,对非字节生态的API集成能力较弱

    2. Dify:开发者最爱、企业首选

    开源LLM应用开发平台,GitHub Stars已超75k,是目前最流行的AI应用开源项目之一。

    核心亮点:

    • 完全开源,可私有部署:Docker Compose一键部署,数据100%自主可控
    • 知识库能力最强:支持PDF/Word/Excel/HTML等10+种格式,混合检索+Reranker优化+知识图谱,RAG能力断层领先
    • 工作流编排最全面:LLM节点、代码执行节点、HTTP请求节点、条件分支、迭代循环、变量聚合……功能最完整
    • 模型接入最灵活:支持100+主流模型,本地模型(Ollama)也能接入,多模型AB对比

    适合场景:企业级AI应用、跨国多语言项目、需要深度定制的技术团队

    不足:需要一定技术背景来部署和管理,学习曲线比Coze陡

    3. FastGPT:知识库问答之王

    专注于企业级知识库问答的开源平台,在医疗、金融、政务等对数据安全要求极高的行业表现突出。

    核心亮点:

    • 知识库问答最专业:QA拆分功能自动将文档转为问答对,召回效果优于通用方案
    • 来源可追溯:答案附带原文出处,用户可以验证信息来源
    • 部署极简:最低2核2GB就能跑,Docker一键部署
    • 数据安全极致:全流程本地化部署,数据完全不出内网

    适合场景:企业知识库、医疗问答、金融合规查询、政务咨询

    不足:插件生态较小,国际化支持有限,工作流灵活性不如Dify

    三、三平台核心对比

    维度 Coze Dify FastGPT
    上手难度 最低(拖拽式) 中等(需技术背景) 中等
    私有部署 不支持 支持(Docker/K8s) 支持(Docker/K8s)
    知识库能力 基础 最强 专业(QA场景最优)
    工作流灵活性 一般 最全面 精简够用
    模型支持 豆包优先 100+模型 主流模型
    插件生态 最丰富 开放API市场 较小
    数据安全 托管字节云 企业级可控 极致本地化
    适合人群 非技术用户 开发者/企业 垂直行业/合规场景

    四、零基础入门:5步搭出你的第一个AI工作流

    以Coze为例(上手最快):

    1. 注册账号:访问coze.cn,用手机号注册
    2. 创建Bot:点击”创建Bot”,填写名称和描述
    3. 配置人设与能力:在Prompt区写明AI的角色和行为规则;在插件区添加需要的能力(搜索、图像生成等)
    4. 添加知识库:上传你的文档(PDF/Word/Excel),AI会自动学习
    5. 测试与发布:在右侧预览区测试效果,满意后一键发布到微信/飞书/Web

    整个过程不需要写一行代码,30分钟内就能搭出一个可用的AI助手。

    五、不同需求怎么选平台?

    • 零基础入门/快速出活→ Coze,拖拽式体验,30分钟出Bot
    • 企业级应用/需要私有部署→ Dify,功能最全面,数据自主可控
    • 知识库问答/数据安全敏感→ FastGPT,专业且极简
    • 想同时满足多种需求→ Dify + Coze组合:Dify做核心业务系统,Coze做快速原型和对外Bot

    六、总结

    2026年,搭建AI工作流已经不再是程序员的专利。Coze让零基础的人也能30分钟搭出AI助手,Dify给企业和开发者提供了最强大的全栈能力,FastGPT则在垂直领域的知识库问答上做到了极致。

    我的建议是:先从Coze上手体验,感受AI工作流的能力边界;有更深需求时再切换到Dify做定制开发。重要的不是选哪个平台,而是现在就开始动手——AI Agent这波浪潮,先上车的先吃红利。

    👉 你在用哪个平台搭建AI工作流?遇到了什么问题?评论区交流!