登录社区云,与社区用户共同成长
邀请您加入社区
《Codex Viz:可视化分析Codex使用日志的实用工具》摘要 Codex Viz是一个将Codex会话日志(JSONL)转化为可视化分析界面的工具,主要功能包括: 整体看板:展示会话数、消息量、Token消耗等核心指标,分析使用趋势和工具调用情况 单会话分析:完整还原任务执行流程,包括Prompt起点、工具调用链和多轮对话逻辑 本地化运行:直接读取~/.codex/sessions数据,无需
本文探讨了AI工具调用测试中的关键问题与解决方案。当AI模型错误生成参数(如虚构枚举值)时,可能导致严重资源浪费,如某物流客服Agent因参数校验缺失而循环调用API,消耗大量token。文章提出通过工具网关进行契约校验:1) 使用Pydantic严格定义参数schema,拦截非法调用;2) 结构化返回错误信息引导模型修正;3) 通过Mock测试验证模型调用行为。测试应覆盖参数合法性、异常处理和任
本文介绍了如何在星图GPU平台自动化部署Qwen2.5-Coder-1.5B镜像,实现中文算法题到LeetCode风格测试用例的智能生成。该模型能理解中文问题描述,自动生成涵盖边界情况的测试用例,适用于面试准备和代码测试等编程辅助场景,提升开发效率。
在 AI 智能体如火如荼发展的今天,"Skill" 这个概念频繁出现在各类技术文章中。但大多数文章只是浅尝辄止地介绍其概念,很少有文章把它的运行机制、设计哲学和实际落地讲透。本文将从 Agent Skill 的本质出发,由浅入深地带你理解:Skill 与普通 Prompt 究竟有何不同、它的三层渐进式架构如何工作、它与 MCP 和 Tool 的分工边界在哪里,以及最重要的 —— 你如何在实际工作中
在现代软件开发与测试流程中,测试数据的准备与管理长期是制约交付速度的关键瓶颈。传统方式依赖手工造数、生产数据脱敏或数据库快照,不仅耗时数小时,还存在数据失真、隐私泄露和环境不一致等顽疾。随着生成式人工智能(GenAI)的成熟,以为代表的合成数据技术正在根本性改变这一局面。这类平台借助生成对抗网络(GAN)、扩散模型、规则引擎与统计建模,按需生成高保真、完全合规且极度多样化的测试数据,将数据准备从“
当测试工程师被迫成为“人肉回归机器”,我们选择用自动化脚本重构职场规则。本指南所有技术方案均经过Tor网络验证,请遵循《网络安全法》合理使用。记住:你的测试用例值得更好的人生版本号。
《致命系统的测试伦理困境》探讨了自主武器系统(LAWS)测试中工程师面临的道德挑战。文章通过风险矩阵对比传统系统与LAWS测试的本质差异,指出毫秒级决策可能造成不可逆的生命损失。研究揭示测试工程师实际参与致命决策构建,63%的敌我识别系统存在欺骗漏洞,模糊测试可能将50米误差转化为战场灾难。作者提出伦理优先的测试六原则,包括可终止性测试和VR替代方案,并开发道德防御工具模型。文章警示当测试用例成为
摘要:本文整理了覆盖测试全流程的高效AI工具清单,包含接口测试(Apifox)、UI自动化(Testim)、用例生成(TestGPT)、脚本开发(GitHub Copilot)、单元测试(EvoSuite)及通用提效工具(豆包)。这些工具兼具易用性和专业度,支持从功能测试到测试开发的转型,部分提供免费方案。重点推荐Apifox的智能接口用例生成、Testim的自愈式UI测试、Copilot的代码自
摘要:本文提供10条提升TestGPT生成测试用例质量的实用技巧:1)明确角色定位为资深测试工程师;2)详细说明业务背景而非仅功能点;3)结构化字段规则;4)指定测试方法;5)要求明确断言;6)聚焦单一功能;7)分步生成优化;8)提供正反案例;9)自动复查修正;10)规范输出格式。核心要点为:专业身份定位、需求拆解细化、规则单独列出、生成后复查补充。遵循这些方法可使AI生成的测试用例达到中级测试工
测试团队负责人深夜思考:如何应对多重管理挑战 本文记录了测试负责人与私教老师关于团队管理的深度对话,针对测试团队面临的三大典型困境提出解决方案:1)在资源有限时,建议跟随直属领导工作重点,寻找多任务的结合点;2)面对60%提测延期,应组织复盘会议、建立分批提测机制;3)质量门禁方面,可通过代码提交检查、自动化通知等机制守住最后防线。文章还探讨了工具集成的务实之道和管理沟通的艺术,强调测试管理需要技
《OpenClaw Skill生态解析:从万级规模到精选应用》摘要 当前OpenClaw Skill生态已形成万级规模,涵盖GitHub社区、ClaudeSkills等多个来源。然而大量Skills存在功能重复、质量参差和安全风险等问题,实际可用精品仅数十个。本文系统梳理了Skill生态的8大应用场景,包括AI自进化、开发者效率、搜索研究等核心领域,并详解了Skill架构设计与安全防护要点。特别建
本文以测试工程师实际场景为切入点,手把手教你基于轻量级 Agent 框架 OpenClaw 实现「AI 自动生成测试用例 + 标准化写入 Excel」全流程。从环境搭建、工具定义到 Agent 执行,全程贴合测试行业规范,代码极简可直接复用,替代传统手动写用例的低效方式,同时对比 Dify 说明 OpenClaw 轻量、代码驱动的核心优势
这两年,测试领域里和 AI 相关的词越来越多:很多时候,这些词会被放在一起讲,听起来都和“AI 更智能了”有关。但如果你真的要开发一个企业级 AI 测试用例系统,就会很快发现:这些词根本不是同一层的概念。它们分别解决的是完全不同的技术问题。如果不把它们的边界讲清楚,系统就很容易做成一个“什么都沾一点,但架构并不清晰”的拼装体。
上周五下午四点,我正在改一个没什么人看的内部文档,突然被拉进一个紧急群聊。群里测试组的老K连发三条语音,语气像丢了孩子:“完了完了,大模型接口调用量上周冲到日均500万了,我们那200条手工用例还在SVN里躺着,一条条复制粘贴到Postman跑,已经连续加了三天班了。我盯着屏幕愣了两秒。不是因为500万,而是因为“200条手工用例”和“SVN”这两个词同时出现在2024年的聊天记录里。
设单次测试通过概率为 $p$,则 $n$ 次重试后通过的概率为: $$P_{\text{pass}} = 1 - (1-p)^n$$ 例如 $p=0.7$ 时,$n=3$ 次重试后通过率提升至: $$1 - (0.3)^3 = 0.973$$当测试用例意外失败时(如网络波动导致),该插件能自动重试执行,提升测试稳定性。通过这个简单插件,你已掌握Pytest插件开发的核心流程!本文将逐步指导你开发一
Playwright mcp执行测试用例