首页
学习
活动
专区
圈层
工具
发布
首页标签AI测试解决方案

#AI测试解决方案

TAPD AI 测试基于DeepSeek和混元大模型重构测试范式,支持AI一键生成测试用例、智能评审需求。

长上下文代码评审的错觉:模型读完仓库,不等于读懂变更半径

霍格沃兹-测试开发学社

结算服务把状态枚举从 SUCCESS 改成 SETTLED,代码智能体一次读完仓库,修改了 14 个文件,补齐了单元测试,PR 评审也没有发现明显问题。

800

长上下文代码评审的错觉:模型读完仓库,不等于读懂变更半径

霍格沃兹-测试开发学社

结算服务把状态枚举从 SUCCESS 改成 SETTLED,代码智能体一次读完仓库,修改了 14 个文件,补齐了单元测试,PR 评审也没有发现明显问题。

1800

Redis 与 MySQL 一致性实战:一次多发 317 张优惠券的故障链

霍格沃兹-测试开发学社

10 万张限量优惠券在 10 点开抢。监控里 Redis 正常、MySQL 正常,接口成功率也没有突然掉到谷底,活动结束后却多出了 317 条领取记录。

1500

测试专用大模型 CodeLlama-34B-Test 深度解析:AI驱动的软件测试新范式

霍格沃兹-测试开发学社

340亿参数、HumanEval准确率53.7%、深度融合符号执行——这款测试专用大模型正在重新定义软件质量保障的边界。

4700

24.5万 Star、安装超2000万次,这套顶级Skills到底强在哪?

霍格沃兹-测试开发学社

需求理解偏了、边界条件漏了、为了改一个功能又顺手动了一堆代码,测试虽然全绿,但做出来的根本不是你想要的东西。

4010

事件只加了一个字段,三个消费者却同时挂了

霍格沃兹-测试开发学社

物流平台把“包裹已签收”事件从 v3 升到 v4,只新增了一个字段:proof_image_url。生产者单测通过,JSON Schema 也通过,灰度后却有三...

3610

首字只要 800ms,用户为什么还是等了 7 秒?

霍格沃兹-测试开发学社

因为很多系统把收到第一个 SSE 事件当成“首字”。那个事件可能只有 role、空白符,甚至只是心跳。用户真正需要的是“订单能否退款、要补什么材料、下一步点哪里...

3310

AI 写的代码跑过 326 条用例,我为什么仍不敢合并?

霍格沃兹-测试开发学社

一个电商结算服务准备上线“跨店优惠按商品金额分摊”。开发用 AI 完成了核心函数,也顺手生成了 326 条单元测试。流水线显示:全部通过,行覆盖率 96%。

4310

600亿买来的Cursor,被OpenAI一脚踢开——聊聊测试人的AI护城河

霍格沃兹-测试开发学社

8月28日,OpenAI发布公告:正式通知SpaceX,将终止向AI编程工具Cursor提供模型,停止日期定在2026年11月12日。

6710

OpenAI Evals:先定义成功,再让 Agent 上线

霍格沃兹-测试开发学社

OpenAI Evals 在 AI 测试里到底测什么?不要先测“回答像不像人”,先把一个业务动作拆成可断言的承诺、边界和解释:硬规则由程序判定,语言质量才交给 ...

4710

Playwright ARIA Snapshot:AI 写的页面,怎么测语义没变?

霍格沃兹-测试开发学社

关键词:Playwright ARIA Snapshot、AI Coding、UI 自动化测试、可访问性树、语义回归

9800

AI 接口全是 200,为什么订单还是被多退了一次?

霍格沃兹-测试开发学社

很多 AI 项目上线前,接口回归是绿的,演示也顺利。可一到真实用户手里,还是出了事:同一笔售后申请因为网络重试被处理两次,客服看到两条退款单,订单系统的库存也被...

8310

测试Skill开发三步走:SKILL.md + scripts + references实战指南

霍格沃兹-测试开发学社

上个月,团队来了个新项目。测试新人小陈接了个“订单取消功能”的用例设计任务,按以往的经验,这活儿至少3天。

12200

4个Agent Skill覆盖所有测试用例设计场景:一套组合拳打天下

霍格沃兹-测试开发学社

上个月,团队接了个电商购物车模块的改版项目。需求文档不复杂,大概十来页。测试组长看了一眼排期,皱了下眉:“按以前的节奏,光写用例就得3天。”

13700

DeepSeek Harness + 知识图谱:企业测试团队,正在长出一支“质量 FDE”

霍格沃兹-测试开发学社

很多企业做完 AI Agent Demo 后,才遇到真正难的问题:为什么它给出了一条错误报价?它看过哪些资料?调用了哪个工具?这次变更究竟该回归哪些场景?

14800

AI 一次改几十个文件,测试怎么决定回归范围?

霍格沃兹-测试开发学社

周五傍晚,研发把一个 PR 丢进群里:“AI 辅助改完了优惠计算逻辑,47 个文件,单测全绿,麻烦测一下。”

10200

DeepSeek Harness 不是测试工具:它会把 AI 测试推进到“验轨迹”的阶段

霍格沃兹-测试开发学社

回归集全部通过:它能识别订单号,能解释退款规则,也能在大多数对话里正确回答“已为您发起退款”。但真正危险的缺陷不在答案里——某次会话中,它在身份核验完成前就调用...

11200

别再只会 assertEquals 了:AI 测试开发要补的 4 个 Skill——LLM 评测、RAG、Agent、MCP

霍格沃兹-测试开发学社

他们团队三月份接了个大模型,做了个"智能客服 + 内部知识库问答"。上线前老板把验收的活儿丢给他:"你给这套 AI 功能出个测试方案。"他愣是卡了两天写不出来—...

13110

相关产品

  • AI测试解决方案

    TAPD AI 测试基于DeepSeek和混元大模型重构测试范式,支持AI一键生成测试用例、智能评审需求。

领券