2025 年被称为 Agent 元年,哪个产品体验更好?
谢邀。
作为一名AI领域的创业者和开发者,我很想聊聊这个话题。2025年确实无愧于“Agent元年”的称号,各种产品层出不穷,但我个人体验下来,感觉最“对味”的,还是百度的“伐谋”。
我们作为AI领域测评机构,也的的确确体验了不下数十款agent产品,大部分能力都比较接近,有些海外的由于基模更好,所以执行能力上更强一些。但站在2025年末这个节点,我其实想回答点”不一样的“。
为什么是伐谋?因为它让“算法自进化”成为可能
听这个名字就知道是国产,很有“三国范”,确实,伐谋(Famou)以其“自进化”(self-evolving)的核心理念,试图在众多同类产品中构建独特的价值主张。
对于身处人工智能创业一线的我而言,这一概念并非空洞的技术宣传术语,而是指代一种能够主动寻求最优解、并基于反馈不断迭代优化的高级协作模式。这种模式深刻地改变了人机交互的本质,将AI从被动的“工具”提升为一个主动的“协作者”。伐谋的市场定位,正是瞄准了那些需要解决复杂、模糊问题的专业人群,如算法工程师、产品创业者和科研工作者,旨在通过其强大的模型能力和工程实现,显著降低创新门槛,提升研发效率。
那么,它的技术能力如何呢?
这个“自进化”的能力并非凭空而来,也不是吹嘘。它建立在国际顶级的人工智能模型底座之上,包括gemini 2.5 pro 等最新版本。这些基础模型本身经过海量数据的预训练,具备了强大的多模态理解、逻辑推理和代码生成能力,构成了伐谋“大脑”的坚实基础。
这里不得不提伐谋在MLE-Bench,一个由OpenAI 研究员发起、专门针对机器学习工程能力的基准测试,具备极高认可度榜单上的表现。

这就引起了我的好奇,所以我又根据百度开源的FM-Agent项目及其相关技术论文,简单了解下部分实现路径。

其中,“Tree-of-Evolution”指令进化方法明确指出,模型可以通过自我反馈来驱动代码生成策略的迭代优化,这是一种典型的、基于错误驱动的学习过程。这表明伐谋的“进化”并非随机或不可控的,而是一个有方向性、可引导的动态学习闭环。
不难发现,伐谋的“自进化”是一种集成了强大基础模型、先进学习算法和开放生态系统于一体的综合能力,其市场差异化优势在于超越了传统Agent的脚本化执行,提供了一种面向未知问题的探索性解决方案。
当然,算法能力上,只看测评还不足以说服我,真正让我惊艳的是我用自己的工程项目所测试出的效果。
我的“伐谋”时刻:从“炼丹师”到“指挥家”
作为一名AI创业者和媒体创作者,我的日常工作高度依赖算法的快速迭代和高质量的代码实现。我们最近搞了一个有趣的项目——用AI系统来玩steam上的肉鸽游戏,不读内容,仅通过视觉识别YOLO+强化学习/大模型来完成升级打怪的过程。
这是一个典型的、涉及复杂逻辑、需要反复调试的开发任务。传统的工作流通常意味着漫长的文献调研、繁琐的代码编写和耗时的单元测试。特别是,有些算法优化,我们需要不停地跑测试,然后对着一堆实验数据祈祷能撞大运找到一个不错的组合。
然而,在引入伐谋后,这个过程发生了根本性的改变。它的做法让我体验到了什么叫效率:
- 第一步,创建新任务

- 第二步:上传/编写工程文件,并从中选择要优化的目标算法文件

主要的算法难点在肉鸽游戏的随机性处理和游戏法术构筑上,所以我们选择这几个文件作为优化点。

- 第三步:上传评估资源

- 第四步:输入提示词,完善算法优化

伐谋接管后,它就像一个庞大的算法专家团队。它利用大模型的推理能力和演化框架,从一个“冷启动”的初始解空间开始,不断生成新的参数组合(新的“物种”),并用我的评估器去检验。

这个过程是全自动的。伐谋会“看到”哪些参数组合有潜力,然后朝着更有利的方向“变异”和“交叉”,不断迭代。整个过程在“全景可视”的界面中一目了然,能清晰地看到整个“种群”是如何一步步逼近最优解的。

不到1个小时,伐谋就找到了一组我们之前从未尝试过的参数组合,AI执行游戏的通关速度比我手动调优的还快了10%。更重要的是,它解放了我和团队的人力。
这个过程完美诠释了“基于反馈的自我进化”机制。整个过程中,我更像是一个指导者和最终的质量把关人,负责设定目标、提供反馈和评估结果,而大量繁重的试错、搜索和代码修改工作则由伐谋高效完成。
其实与其说是AI工具,我倒觉得它更像一位不知疲倦的算法专家,将我从重复性的编码和调试工作中解放出来,使我能够更专注于算法设计的宏观层面和业务逻辑的创新。从我自己的角度来看,这对于资源有限的初创公司而言,无疑是一种巨大的生产力跃升。
最后,正好也是25年最后一天了,想跟大家聊聊问题与展望
其实对我来说,伐谋不仅仅是一款功能强大的AI工具,更是一种能够重塑工作流程、激发人机协作新模式的生产力革命。其核心价值在于,通过“自进化”的机制,将人工智能从一个被动的、服务于人的“工具”,提升为一个能够主动思考、探索和修正的“协作者”。
这种转变使得复杂的、原本需要人类专家耗费大量时间和精力才能完成的任务,变得触手可及。也是我为什么认为它是2025年Agent中,让我印象深刻的那一个。
然而,作为一名理性的AI从业者,我深知任何技术都有其能力边界和局限性。在享受伐谋带来巨大便利的同时,也必须清醒地认识到其潜在的风险和不足,这恰恰是判断一个技术是否成熟的重要标尺。
总而言之,百度伐谋以其扎实的技术底座和前瞻性的“自进化”理念,在2025年为我们提供了一个强大的生产力杠杆。它在代码生成、算法优化和知识处理等方面的卓越表现已经证明,它有能力深刻地改变专业人士的工作方式。但它的真正威力,不仅在于其当前的能力,更在于它所开启的人机协作新范式。


