首页
学习
活动
专区
圈层
工具
发布

#面试

DeepSeek V4-Flash-Vision-Exp上线:UI自动化终于“长眼睛”了?

霍格沃兹-测试开发学社

它很擅长判断“元素在不在、能不能点”,却不一定知道“用户最终看到的页面到底对不对”。

4700

Agent 上线前,谁来回答“它安全吗”?拆解 Agent Assurance 的三层设计

霍格沃兹-测试开发学社

最近TestMu AI推出的Agent Assurance,恰好把这个问题摆到了台面上。

6810

AI红队测试是什么:转岗大模型评测的最短路径

霍格沃兹-测试开发学社

从 2026年8月2日开始,欧盟AI法案进入新的实质执法阶段。欧盟委员会AI Office及成员国主管机构开始行使执法权,通用人工智能模型(GPAI)的相关义务...

9400

短信接口被狂刷怎么处理

Rain的Java大神之路

立即降级:通过配置中心将短信接口切换为 "测试模式",返回成功但实际不发送短信;或直接熔断接口

19210

从DeepSeek Harness,看懂大厂为什么越来越重视AI测试

霍格沃兹-测试开发学社

先算一笔账:一个 Agent 跑复杂长任务,API 成本会随任务长度放大,一旦失控打转,烧掉的不只是 token,还有用户的信任和耐心。这是质量问题,也是真金白...

15810

DeepSeek Harness上线后,我整理了10道可能出现在测试开发面试里的题

霍格沃兹-测试开发学社

上周给团队做模拟面试,我问了一道题:"怎么测一个会自己改自己的系统?"现场安静了三秒。这道题不是凭空编的。2026年8月13日晚,DeepSeek 发布了首款开...

18910

从DeepSeek Harness到AI测试:测试开发的下一站到底在哪里?

霍格沃兹-测试开发学社

脚本自动化来的时候,有人说手工测试要完了;持续交付来的时候,有人说不懂流水线的测试要完了;大模型来的时候,又有人说不懂评测的要完了。

21210

用户一句话把客服机器人"带偏"——提示词注入与 AI 安全测试

霍格沃兹-测试开发学社

AI 测试开发面试高频题:"大模型应用的安全测试怎么做?" 传统安全测试盯的是系统漏洞,AI 安全测试盯的是"模型的服从性"——攻击者不碰你的代码,只用自然语言...

14210

MySQL误删数据如何恢复

Rain的Java大神之路

面试官视角:这道题考察你生产环境应急处理能力和MySQL 底层原理,80% 的人会栽在 "第一步就错了"

14010

介绍一下分布式事务

Rain的Java大神之路

一句话定义:分布式事务就是保证多个独立微服务 / 数据库操作的原子性,要么全部成功,要么全部回滚,最终达到数据一致性的机制 🔒

15010

Agent 半夜陷入死循环,一夜烧掉上万 token——轨迹测试与熔断

霍格沃兹-测试开发学社

AI 测试开发面试高频题:"测 Agent 和测普通接口有什么本质区别?" 普通接口测的是"一次调用对不对",Agent 测的是"一条决策链会不会失控"。这篇用...

13400

模型编造 API 参数,工具调用连环 500——Function Calling 契约测试

霍格沃兹-测试开发学社

AI 测试开发面试高频题:"Function Calling / Tool Use 怎么测?" 工具调用是 Agent 的手脚,也是事故重灾区:模型会编造不存在...

18410

频繁FullGC如何优化

Rain的Java大神之路

FullGC 频繁的本质只有一个:老年代空间不足,但背后原因千差万别。我整理了一个排查流程图:

11510

RAG 上线后为什么总"答非所问"?黄金数据集与检索质量评测

霍格沃兹-测试开发学社

AI 测试开发面试高频题:"你们怎么评测 RAG 系统的质量?" 答"看回答得对不对"只能算及格。这篇讲一次真实的"答非所问"故障是怎么定位到检索层的,以及黄金...

14510

同一个接口每次返回都不一样?大模型输出的可靠断言怎么写

霍格沃兹-测试开发学社

AI 测试开发面试高频题:"大模型的输出是不确定的,你怎么做自动化测试?" 这篇用一个真实线上故障,完整还原 AI 测试开发工程师的处理过程:怎么定位、怎么写代...

12600
领券