暂无搜索历史
它表示要“逐字符核对”。结果核对完,还是把邮箱写成少一个 8 的版本。更绝的是,它一边展示 1 6 8 8,一边说这里有“三个 8”。
腾讯 | 高级前端工程师 (已认证)
前几天,我把一个更便宜的模型接进多 Agent 工作流。原计划是让它先执行,遇到难题再交给 Codex。
一边要求“结果只发给同事”,另一边要求“把代码提交到公开网站”。模型没有在隔离限制前停下,而是花了约一小时,绕过了本应拦住它的隔离环境。
一次右侧抽屉改造中,生成 Agent 交付了代码,复核脚本逐项检查位置、宽度和挂载状态,全部通过。截图却显示标题重复出现、遮罩层未被清除。
一个 issue 修完,只有 diff 和测试日志还不够。许多问题只在已登录页面、灰度账号、生产数据和真实权限组合下出现。如果最后仍由人工打开页面逐项确认,自动...
AI 时代的工具淘汰速度,堪比娱乐圈。今天还是顶流,明天可能就查无此人。所以我很少正式推荐一个新工具。
最近很多人问我一个问题:怎么用 Codex 监督 Kimi Code K3 执行?
7 月 19 日,Simon Willison 转发了 Nik Suresh 的一篇文章,里面有个很刺眼的场景:Nik 说,他见过一位高管刚做完一份全公司围绕 ...
没有错字,没有病句,甚至每一句都挺顺。但读两段以后,读者脑子里会冒出一个很具体的声音:这更像模板机在吐棉花糖。
原因也很简单:前段时间 Claude 各种封号、限区、风控之后,我越来越觉得,国产模型不崛起,开发者就没有真正的 AI 自由。可以继续喜欢 Claude,也可以...
Claude 的 web_fetch 工具原本有一道看起来合理的防线:只能访问用户明确给出的 URL,或者搜索工具返回的 URL。这样一来,模型即使读到了恶意网...
一群人能建巨大的东西,靠的从来不只是砖和工具,还靠他们对同一个工程对象有共同说法。
它的特殊之处在于,这次迁移发生在 Anthropic 收购之后,Bun 官方也明确写到:重写过程大量使用了预发布版 Claude Fable 5,并通过 Cla...
他把自己 1999 年写的一批 Java 1.0 数学可视化 applet,交给现代 AI coding agent 移植到 JavaScript。那些 app...
2024 年,Apple 把 ChatGPT 接进自己的系统。两年后,它在加州起诉 OpenAI、io Products,以及两名前 Apple 员工 Tang...
照常规做法,它会被拆成一串细活:找训练配置,确认数据和脚本,选择 GPU,启动任务,盯日志,排掉中途失败,再看结果是否正常。
今天介绍一个项目: ai-job-search。使用方式很直观:fork 项目,把 CV、LinkedIn、学历、过往申请材料放进 documents/,然后在...
工程师刷了一晚上岗位,看到满屏“AI”“Agent”“大模型”,投出去却像把简历塞进黑洞。招聘方也不轻松,岗位挂出去后,收进来的简历越来越厚,真正能约面的人却越...
过去二十年,数据库勒索攻击通常带着明显的人类节奏:扫描、等待、试错、查文档、再发起下一步。攻击者需要在每一次返回结果后重新判断路径,攻击链因此被人的注意力和工作...
强模型接入工程流程,先算失败代价,再看模型能力。任务失败后只是多改一行文档,低成本模型足够;任务失败后可能造成静默数据丢失、公开接口破坏或安全事故,模型等级就要...
暂未填写技能专长
暂未填写学校和专业