• ARTICLE
  • STRING
  • CONVERTER
  • ENCRYPT
  • NETWORK
  • MORE
    CHART
    MATH
    COORDINATE
    IMAGE
    FILE
    OPEN API
  • ARTICLE
    STRING
    CONVERTER
    ENCRYPT
    NETWORK
    MORE
    CHART
    MATH
    COORDINATE
    IMAGE
    FILE
    OPEN API
logo Online Tools
All Chinese English Newest Hottest
1917 search results

本文介绍了一个面向数据开发团队的数据需求交付 Agent Skill。该技能通过自然语言交互(可以是从 Aone、钉钉消息、PRD 中提取的描述),输出是一份结构化的 Copilot 交互物(prompt),可以直接复制到 DataWorks Copilot 或调用其他大模型中生成高质量 SQL 代码。让数据研发从“依赖人的连续投入的串行排期”转变为“Agent自动执行,人按优先级介入决策的并行推进”。文章从背景痛点、skill介绍、实战场景、核心能力拆解等方面系统展开,并在最后给出总结与展望,希望为同样在做数据质量保障和 Agent 工具落地的开发者提供参考。(文章内容基于作者个人技术实践与独立思考,旨在分享经验,仅代表个人观点。)

2 Technology lddgo Shared on 2026-07-20

本文系统性地回顾了我们在构建企业级 AI Agent 平台过程中走过的完整技术演进路径——从大模型的先天约束出发,经历 Prompt 工程、Context 工程、Harness 工程三个阶段,最终演化出一套五层架构的 Agent 操作系统。每一层的出现都是因为前一层遇到了天花板。(文章内容基于作者个人技术实践与独立思考,旨在分享经验,仅代表个人观点。)

1 Technology lddgo Shared on 2026-07-20

支付宝商家中心(b.alipay.com)是支付宝官方的商家服务平台,面向蚂蚁生态内所有商家,聚合产品签约、账户资金管理、营销运营、账单对账等能力,为商家提供一站式综合服务,帮助其更高效地开展日常经营,我们团队负责该平台的 PC 端业务测试。

9 Technology lddgo Shared on 2026-07-17

本文介绍了“高价率运营 AI 工作台”中基于“约定驱动 + AI 编排”架构的自动化评测优化实践。针对 LLM Agent 场景下传统测试失效、反馈周期长等痛点,文章详细阐述了将评测体系作为核心工程产物的设计方案:通过标准化目录结构固化规范,利用 Coding Agent 实现自然语言驱动的全流程自动化;构建包含真实业务数据驱动的评测集生成、14 个通用维度与专项指标结合的 Rubric 体系、以及采用二元评分机制的 LLM Judge 双引擎架构(auto-evaluation 与 pinchbench-eval)。同时,文章深入剖析了金标设计中的信息隔离、粒度匹配等关键陷阱,并探讨了从半自动向全自动演进过程中,在评测入口、指标自动迭代及记忆机制等方面面临的技术挑战与应对策略,最终实现了将 Skill 可用性从主观判断转化为可量化、可复跑的工程闭环。

11 Technology lddgo Shared on 2026-07-17

过去一个月,我们在搭建一个面向本地生活业务的分析类 Skill,让 AI 能像资深分析师一样做经营诊断、归因拆解和趋势预测。业务覆盖几十个行业,每个行业有独立的经营框架和指标体系,复杂度远超一个 prompt 能承载的范围。搭建过程中,我们经历了三次架构重构(V1 → V2 → V3),每次都是被真实问题逼出来的。这篇文章完整复盘了这个演进过程,最终提炼为六条 Skill 架构设计原则。如果你正在搭建领域知识密集型 Skill,或正面临「prompt 越写越长但效果越来越差」的困境,这篇文章或许能够提供一些思路。每章独立成节,可按需跳读。

13 Technology lddgo Shared on 2026-07-17

淘宝闪购爆品团业务排序模型过去很长一段时间更像是在“堆模块”:遇到一个问题,就补一个结构。短期看,这种方式能持续拿收益,但当模型越做越大,结构碎片化、计算不够稠密、调参成本高等问题会越来越明显。这次爆品团排序模型升级,核心不是再增加一个局部模块,而是把主干从传统 DLRM 架构切到 Token-Based 的 RankMixer 架构。围绕这条主线,我们系统做了负采样、多任务学习、序列建模、Tokenization、FFN、MoE 和 Task Tower 等结构消融。多期迭代后,模型规模从 85M 扩展到 107M,再到 243M,并在爆品团频道页取得了稳定线上收益。

11 Technology lddgo Shared on 2026-07-16

数据研发Multi-Agent架构的Harness工程实践

13 Technology lddgo Shared on 2026-07-15

本文提出 AI Native 能力成熟度模型(AINMM),为软件工程组织提供AI原生研发能力的评估与提升框架。AINMM 借鉴 CMMI 思想,定义了五个成熟度等级(ML1-ML5):从 ML1 “AI 认识项目”到 ML5 “组织级自进化”,围绕五大过程域(上下文工程、能力封装、验证回路、协作契约、自进化)构建。模型针对存量工程转型痛点,提供可测量、可比较、可指导的渐进式路径,避免“big bang”式重构。配套 AI Native Evolution Kit 工具支持自动化评估与演进。通过挽单系统实践验证,该框架能准确定位团队 AI 能力短板,指导从“AI 辅助”向“全链路 AI 驱动”的系统性转型,助力实现十倍级效率跃迁。AINMM 不是银弹,而是随实践持续进化的工程指南。

11 Technology lddgo Shared on 2026-07-15

我们在做数据研发领域的 AI coding,在建设项目能力的过程中和集团很多的 BU 都有深入的交流,今年发现大家除了端到端的交付外,大家都在探索"超级组织",我们通过「 Loop Engineering」和「知识工程」解决复杂工作流的稳定性与自动化问题,搭建了“数研超级组织”的雏形 ~ 

33 Technology lddgo Shared on 2026-07-14

从 Coder 到 Designer :电商团队数据研发的 Harness Engineering 实践

18 Technology lddgo Shared on 2026-07-14