知识问答的核心挑战是准确率和质量。一个回答要准确,需要:查得全(召回率),查得准(精准度),理解得对(多模态),看得对(权限隔离)。这些能力不是堆功能就能实现的...
从 24 年冬天开始,各类 coding agent 层出不穷——从 Gemini CLI 的起步,到 Claude Code 的尝试,再到如今 Codex、O...
先说结论:用了三个月,我加班少了,摸鱼理直气壮了。 不是软文,就是普通打工人的真实感受。
订单系统是交易链路的核心命脉,直接承载用户所有下单与支付行为,其稳定性直接决定业务盈亏。为此,我们耗时一年多,完成了订单系统由外而内的三阶段改造。
用了一段时间 WorkBuddy 后,我发现它最被低估的功能是自动化任务。大多数人只把它当聊天工具用,却不知道它可以设置定时任务,每天自动帮你干活。本文手把手教...
在推荐系统中,CTR 和 CVR 等硬性指标往往容易通过实时数据进行观测,但新颖性、相关性等评价维度由于主观性强、反馈周期长,长期处于量化黑盒状态。本文将介绍得...
向 ChatGPT 询问企业内部系统相关问题,常会出现这样的情况:它给出一段看似逻辑通顺、实则完全错误的回答,不少人都遇到过类似状况。
听不懂人话、自作聪明: 无法准确理解用户意图,频繁答非所问。人工成本高、排队严重: 高并发场景下人力无法覆盖。问题解决能力弱: 只能处理简单 FAQ,复杂多轮问...
「得物推荐 AI Harness 工程化实践系列」的中篇内容,本系列共三篇连载。本篇(中篇)进一步详解得物推荐复杂业务场景下,AI代码从生成、防护校验到安全上线...
得物是全球领先的集正品潮流电商和潮流生活社区于一体的新一代潮流生活方式平台。复杂的业务场景和极致的用户体验追求,对数据库运维和选型提出了更高要求。
测试用例平台积累了大量描述性用例,但不可直接执行。QA 需要逐条手动翻译:理解业务逻辑、编写元素定位、调试执行路径。一个中等规模的模块,转化成本可能需要数人天。
本文是得物技术专家在 AICon 上海演讲整理的技术实录。 「得物推荐 AI Harness 工程化实践系列」的开篇内容,本系列共三篇连载。将系统拆解得物推荐复...
一场营销活动从策划到上线,运营要在三个系统间跳转 10 + 次、填写 40 + 个字段。我们用 AI 重新设计了这条链路 —— 从 “AI 帮你填表单” 到 “...
在埋点和指标需求里,最消耗数据承接方的往往是把分散的信息重新拼起来:需求文档里的动作到底要不要采集,历史上有没有类似点位,指标口径有没有被下游使用,新增字段要改...
每次打开 Claude Code 开始新对话,它都是一张白纸。昨天你花了 10 分钟解释的项目架构、你反复纠正的代码风格偏好、你建立的特殊开发规范——全部归零。...
使用 WorkBuddy 两个月,踩过坑也摸出门道。分享一些真正能提升效率的用法,新人少走弯路。
告警来了,第一反应是打开日志平台搜关键词,切到 APM 看监控曲线,再去链路追踪系统找 trace 详情。三个平台来回切换,最后发现只是上游 GC 抖动导致的瞬...
第一次用WorkBuddy,是在一个深夜。我急需整理一份复杂的课堂数据,抱着试试看的心态打开了它。
HorizonVault 是中间件团队自研的一款高吞吐分布式存储引擎,主要面向 Kafka 远程存储、冷/温数据下沉和大容量低成本存储场景。随着 Kafka 集...