架构 第4页

Agents 不做站会了:PFF 怎么把工程组织从“帮工程师提速”改成“帮 Agent 提速”-IT资源栈

Agents 不做站会了:PFF 怎么把工程组织从“帮工程师提速”改成“帮 Agent 提速”

这篇内容最值得看的地方,是它把视角直接抬到了组织层。Mike Spitz 没沿着“工程师配上 AI 之后效率更高”这条熟悉叙事往下讲,他干脆换了问题本身,从“如何让工程师产出更多”切到“如何让 agent 在组织里跑得更快”。问题一换,站会、Sprint Planning、Retrospective、代码评审分工、QA

Arize 怎么解决 Agent 的上下文管理:系统为什么会被 Context 拖垮-IT资源栈

Arize 怎么解决 Agent 的上下文管理:系统为什么会被 Context 拖垮

这篇文章讲的是一个很容易被低估、但几乎所有 Agent 产品都会撞上的问题:上下文管理。Sally-Ann Delucia 这场分享的价值很直接,她没有泛泛谈“长上下文很重要”,直接把团队在真实产品里踩过的坑讲清楚了,尤其是为什么截断不行、为什么总结也不稳,以及最后为什么留下来的是一套更克制的 context + me

从静态 benchmark 到活的 eval:Vincent Koc 这场分享,真正戳中的不是评测,而是 agent 软件的变形速度-IT资源栈

从静态 benchmark 到活的 eval:Vincent Koc 这场分享,真正戳中的不是评测,而是 agent 软件的变形速度

很多人现在一提 eval,脑子里冒出来的还是老三样:题库、benchmark、离线跑分、回归测试。这个思路在过去不是错的。问题是,今天的 agent 系统已经越来越不像“一个发布后基本不动的程序”了。它会接工具、会吃上下文、会随着用户习惯漂移,甚至连 harness 自己都可能被改写。你还拿一套静态题库去盯它,基本等于

Dense vs MoE:大模型架构的选择题-IT资源栈

Dense vs MoE:大模型架构的选择题

选 Dense 还是选 MoE?这个问题在 2025 年之后已经不怎么争议了——大多数顶级闭源模型(GPT-4 系列、Gemini、DeepSeek-V3)都用了 MoE。但这不意味着 Dense 没用了。两种架构各有清晰的能力边界,选错架构的代价远大于选错模型大小。 Dense 模型就是传统的 Transformer

赞(0)易安易安阅读()
QMD 实战:让 Agent 的知识检索从 grep 升级到 BM25+向量混合搜索-IT资源栈

QMD 实战:让 Agent 的知识检索从 grep 升级到 BM25+向量混合搜索

Agent 有个老问题:它知道怎么写代码、怎么查资料、怎么调用工具,但它不知道你自己的东西在哪里。 我说的不是联网搜索——Google 和 Bing 它已经会用了。我说的是你自己沉淀下来的那堆 Markdown:项目文档、SOP、会议纪要、故障排查记录、个人笔记。这些东西分散在十几个目录里,几百个 `.md` 文件,A

赞(0)易安易安阅读()
RSS 周刊第 4 期:这一周,Agent 圈开始从“大家都能用”转向“谁还供得起、守得住、跑得稳”-IT资源栈

RSS 周刊第 4 期:这一周,Agent 圈开始从“大家都能用”转向“谁还供得起、守得住、跑得稳”

这一周最值得记住的,不是哪家模型又发了一个新版本,也不是哪家厂商又多说了几句 Agent 愿景。 真正变硬的一条线,是 Agent 开始全面撞上生产现实。算力不够,订阅收紧,漏洞变成供应链入口,观测和权限开始补票,平台厂商也不再只卖“更聪明”,而是在卖“更稳、更可控、更能接进现有系统”。 如果把这一周的 RSS 原料压