• Open API
  • 文库
  • 字符
  • 转换
  • 加密
  • 网络
  • 更多
    图表
    数学
    坐标
    图片
    文件
  • Open API
    文库
    字符
    转换
    加密
    网络
    更多
    图表
    数学
    坐标
    图片
    文件
logo 在线工具大全
所有 中文 英语 最新 热度
6603 条查询结果

MemoHarness来了:Agent的下一次进化,开始发生在模型之外

69 技术 lddgo 分享于 2026-08-06

告别“黑盒”与误判:如何用“多智能体对抗辩论”重构内容安全审核系统

73 技术 lddgo 分享于 2026-08-06

本篇博客是一篇科普文章,由浅入深的介绍Agent评测。其中前两章系统介绍了评测是什么,以及如何建立评测体系;其中第二章是美团图灵Agent评测团队深入美团各业务团队BP总结出的实践经验,是我们在两年实践过程中逐步打磨出来的认知。第三章重点介绍了龙虾/爱马仕这类长程Agent框架的出现对评测带来的变化。本篇博客在美团内部发表之后获得了较多的关注,我们发现大家对Agent评测的热情非常高,因此我们决定将内部博客进行公开,想把这些经验分享给更多的同学,希望对大家有所启发或帮助。

75 技术 lddgo 分享于 2026-08-06

模型越来越强, harness该留下什么?

65 技术 lddgo 分享于 2026-08-06

当智能体真正开始干活,企业管理也该变革了

69 技术 lddgo 分享于 2026-08-06

Linux 内核藏了 18 年的漏洞,这次 AI 比所有人先找到

68 技术 lddgo 分享于 2026-08-06

从个人Agent到企业级数字分身:组织AI native转型的“最后十公里”

67 技术 lddgo 分享于 2026-08-06

过去一年,AI 编程工具集中爆发——有的专注补全提示,帮开发者把代码写得更快;有的用对话交互驱动开发,一句话就能改代码;有的深度融入编辑器,AI 能力触手可及。这些工具都在解决同一个问题:如何降低"写代码"的门槛。 但当门槛降低之后,一个新的问题随之浮现——如何用好这些工具。工具本身的能力在那里,但体验好不好,很大程度上取决于是否掌握了正确的使用方式。 这篇文章整理了我在 Claude Code 上摸索出的一些实用技巧:如何让 AI 遵守项目规范、如何让重复操作自动执行、如何拦截危险操作、如何在长对话中保持回答质量。抛砖引玉,如有错误或疏漏,欢迎指正。

77 技术 lddgo 分享于 2026-08-05

缩小上下文鸿沟: 一种本体论 + 大语言模型的数据现代化方法

20 技术 lddgo 分享于 2026-08-05

该文介绍了复杂业务场景下AI研发交付的实践方案,团队将流程分为三阶段,重点打造第一阶段底座。通过分层知识库设计(main全局业务、applications应用知识、candidate候选知识、personal个人经验、template模板),确保AI获取准确上下文;采用文件化的RD流程,用Markdown承载需求分析、拆解、实现校验全过程,使研发状态可接续、可review;前置质量门禁,在PRD验证、需求澄清、方案设计等关键节点设置人机协同review点,避免后期高成本返工。不追求100%全AI交付,强调AI负责分析实现、人聚焦关键判断,通过知识沉淀与流程规范提升整体交付质量与稳定性,为后续自动化和多Agent协同奠定基础。

70 技术 lddgo 分享于 2026-08-05