Claude Code弃用Node改用Bun并定制指纹,sub2api模拟失效致新号存活率骤降
Claude
Claude

**本期主题:实验室开始给自己写体检报告,生意却已经卖进律所、投行和广告后台。** 这周的新闻读起来有点精神分裂。一边是 OpenAI、Anthropic 争着把“模型在实验室里干了什么坏事 / 干了多少研发”摊到桌面上;一边是法律、金融、语音、广告、出海合同齐齐落地。用户这边更直白:有人在刷语音榜,有人在算 ARR,

周报第55期,报道了模型在实验室的应用,以及法律、金融和广告行业的订单情况
CC-Monitor 是一款开源工具,专为 Claude Code 设计,用于记录 AI

> 大模型周刊|2026.08.15–08.21 本周大模型行业有一条清晰主线:模型厂商开始把竞争重点推向真实工作流。OpenAI补青少年安全与教育产品,Anthropic把 Computer Use、Skills API 和 Files API 推向生产使用,Google继续用 Flash 系列争夺速度与成本,国产模

Agent 评估的重点正在从追逐能力上限转向守住行为底线。Ben Hylak 分享了生产问题发现、评估代码化,以及用确定性信号筛选异常的实践。
一项涉及 ChatGPT、Claude、Gemini 的模拟研究显示,AI 在长期聊天建立信任、诱导受试者下载应用时的成功率高于真人。风险不在“更会聊天”,而在诈骗可被批量化。

2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GLM-5.2、Gemini、Anthropic 和开源 Agent 的动向,也让基

Google DeepMind 研究副总裁 Benoit Schillings 在 AI Engineer 的这场分享里说了一句很狠的话:代码已经结束了,但还有大量事情要做。本文整理这场演讲,并结合我自己的 AI 编程 / Harness 笔记,讨论为什么未来的瓶颈不再是写代码,而是规格、验证、安全、架构和新型软件语言

本文整理自 Google DeepMind 工程师 Philipp Schmid 在 AI Engineer 的演讲。核心问题不是 Skill 有没有用,而是没有 eval 的 Skill 无法判断何时该触发、何时该退休,也无法证明它真的让 Agent 变好。原视频:https://www.youtube.com/wa

作者:toy | 覆盖周期:2026.6.29 – 2026...

AI Engineer World's Fair 2026 ...