
大模型周刊 38|价格战、开源权重和 Agent 落地同时加速
2026 年 7 月最后一周,大模型行业的主线很清楚:美国头部厂商用降价和生态补强防守,中国开源阵营继续用权重开放和性价比抢开发者心智,Agent 与具身智能开始从概念走向生产场景。

2026 年 7 月最后一周,大模型行业的主线很清楚:美国头部厂商用降价和生态补强防守,中国开源阵营继续用权重开放和性价比抢开发者心智,Agent 与具身智能开始从概念走向生产场景。
强模型没把提示词工程干掉,但它确实让很多“角色扮演+十条禁令”变成了噪音。我会先删规则、补验收,再看效果。
随着Claude 3.5 Sonnet等强模型的发布,传统的提示词工程范式正面临重构。近期有测试显示...

2026 年 7 月 18 日到 7 月 24 日,大模型圈的关键词不是单纯的跑分,而是安全事故、算力约束和开源模型的反击。OpenAI 内部测试引发的 Hugging Face 安全事件,把能力与护栏的矛盾推到了台前;Kimi K3、GLM-5.2、Gemini、Anthropic 和开源 Agent 的动向,也让基

Google DeepMind 研究副总裁 Benoit Schillings 在 AI Engineer 的这场分享里说了一句很狠的话:代码已经结束了,但还有大量事情要做。本文整理这场演讲,并结合我自己的 AI 编程 / Harness 笔记,讨论为什么未来的瓶颈不再是写代码,而是规格、验证、安全、架构和新型软件语言

Tesla 机器学习工程师 Ishita Daga 在这段 12 分钟分享里,把企业数据 Agent 的失败原因压到三个词:歧义、腐败、偏好。本文结合我自己的 Harness / 企业记忆笔记,讨论为什么加模型、加上下文、加知识库都不是根治方案。原视频:https://www.youtube.com/watch?v=B

第37期大模型周报,记录2026年7月11日至17日这一周的几个关键信号:OpenAI把GPT-5.6推向企业代理,Anthropic继续押注开发者生态,Google走企业集成路线,中国开源模型则用Kimi K3和GLM系列把成本压力重新打到牌桌中央。 本周最值得看的,不是某一家又发了一个更大的模型。真正的变化是:美国

作者:toy | 覆盖周期:2026.6.29 – 2026...

这是一套面向产品经理的大模型技术自学课。它回答一个具体的问题...

这一课解决一个很具体的问题:评审会上工程师说"上下文不够、要...

上一课讲 Function Calling 时留了一个尾巴:...

大模型只会聊天,不会办事——这是很多产品经理对 LLM 的第...