为什么
Claude 一天能写完老员工一周的活。issue 自己读、PR 自己改、CI 红了自己重跑——日常的事,它做得不慢。
工程师还能做什么?判断它写得对不对,决定下一步做什么,把它写歪的地方掰回来。这考试就考这几件事。
prompt cache、subagent、hooks、MCP——不查文档你能说清楚吗?
什么活该 Opus、什么活给 Haiku、什么活根本不该用 AI。
浏览器、Unix、搜索引擎、Markdown——2010 年的本事,2026 年还要会。
评分
编程题和模糊填空交给 Claude Sonnet。rubric 和题面用cache_control: ephemeral共享,同题多人答命中 cache。
feedback: 实现了核心功能,边界处理到位, 命名清晰,代码符合 rubric 主体。 strengths: + 提前 return 减少嵌套层级 + 用 Map 而非 Object 做缓存 issues: - 缺少对空数组的判断 - 可以用 reduce 替代 forEach
FAQ
可以。开卷,可以问 AI、可以查文档——我们考的就是这个。请独立提交。
看考卷。出题人可以开「允许重考」,没开的话一次定终。
出题人写 rubric,所有人共用同一份。分数明显不对找管理员复核。
内部能力画像。不和 KPI 挂钩。
选择和填空可以。编程题别想——Monaco 编辑器要键盘。