AI 我们用 RealVuln 测试了 AI 代码扫描工具:召回率、精确率与误报对比 摘要(更新于 2026 年 7 月 20 日) :2026 年 6 月 17 日,我们拿 RealVuln 测了一遍 MonkeyScan,也记录了 Dee
AI AI 评测系列(02):评测指标设计——从业务目标到可量化指标 指标缺失时会发生什么 一个 RAG 问答系统上线了。工程师说"测试都通过了"——API 响应时间 < 2 秒,格式正确,没有崩溃。 两周后用户反馈说"AI
AI AI 评测系列(01):为什么 AI 评测难——不确定性、主观性与多维度 传统软件测试的假设 传统软件测试建立在三个假设上: 输出确定 :相同输入给相同输出,测试可以复现 正确性可判定 :函数返回 42 是对还是错,有明确标准 维
AI Claude Code 是什么?AI 编程命令行工具使用教程 Claude Code 是 Anthropic 推出的 AI 编程工具,能在终端里理解代码库、自动改代码。本文讲清它的用法与订阅支付。
AI AI 测试提效神器:推荐一款接口自动化测试提效skill! 导读 :前面我们已经分享过了,如何用 AI + Agent Skill 把接口测试脚本自动"造"了出来。但脚本生成只是起点——真正让接口自动化测试产生价值的
AI 2026 年 AI 编程助手怎么选:GitHub Copilot、Cursor、Claude Code 横评 AI 写代码已成开发者标配,但工具越来越多该怎么选?本文对比 Copilot、Cursor、Claude Code 的定位与适用人群,帮你少走弯路。