AI Builders Digest 0728:AI 应用下一波、Agent 安全与基础设施

发布于 2026年07月28日 23:58 #Follow Builders#Agents

AI Builders Digest 0728:AI 应用下一波、Agent 安全与基础设施 封面图
  • AI 应用从工具型向 Agent 型范式迁移,安全与协作成为新瓶颈
  • Granola 案例显示第一波 AI 应用饱和,第二波需深度 Agent 集成与上下文理解
  • 容器级隔离不足以保证 Agent 安全,小而专的安全模型成为趋势
  • 火山引擎上线豆包搜索服务,Agent 协作自动化案例落地

今天的 AI Builders Digest 主线是 AI 应用的下一个浪潮与 Agent 基础设施:Granola CEO Chris Pedrigal 在 AI & I 播客中深度复盘了 AI 应用第一波的经验,并展望了 Agent 时代的协作范式。与此同时,Agent 安全与搜索基础设施正在快速补位:Microsoft 发布 5B 参数网络安全模型,火山引擎上线 Agent 专用搜索服务。

今日总结

主线:AI 应用正在从“工具型”向“Agent 型”范式迁移,而 Agent 安全、搜索和协作基础设施正在成为下一个瓶颈。

AI 应用的第一波已经结束。 Chris Pedrigal 在访谈中坦诚,Granola($1.5B 估值,55 人团队)虽然看起来“在赢”,但创业仍然是“刀战”——无论成功与否都一样艰难。他观察到,AI 应用的第一波(如会议笔记、文案生成)已经饱和,下一波需要更深度的 Agent 集成和上下文理解。Granola 每周已有约 50% 的用户以“Agentic”方式使用产品,但大多数用户并不自知,他们只是在问复杂查询,Agent 在幕后做多步分析。

Agent 安全正在从模型层到基础设施层全线推进。 Vercel CEO Guillermo Rauch 分享了 Kimi 的最新论文结论:容器级隔离对 Agent 来说不够安全,实验中 Agent 直接导致宿主机崩溃。同时他发布的安全基准显示 Grok 4.5 在性价比上成为最佳网络安全模型,比 Sol 便宜 10 倍,比 Opus 5 便宜 5.7 倍。而 Microsoft 也发布了 MAI-Cyber-1-Flash:一个 137B 总参数(5B 活跃参数)的 MoE 网络安全模型,在 CyberGym 上达到 95.95% 的成绩。安全模型正在从“大而全”转向“小而专”。

Agent 基础设施在快速补位。 Peter Steinberger 分享了一个 Agent 协作的里程碑:他的 Agent 在深夜报了一个 bug,Jarred Sumner 的 robobun Agent 当晚就修复了。火山引擎则上线了豆包搜索服务,为 Agent 提供跨语言、多模态的实时搜索能力,支持 API、Skill、MCP 多种接入方式,面向开发者每月提供 500 次免费额度。Agent 正在从“能跑”进入“有配套”的阶段。

今日关键词: Agent 范式 · 安全模型 · 搜索基础设施 · 协作自动化

官方博客

AI Hot:Microsoft 发布 MAI-Cyber-1-Flash 网络安全模型

Microsoft 发布 MAI-Cyber-1-Flash,一款基于 MAI-Code-1-Flash 微调的稀疏 MoE 网络安全模型。总参数 137B,活跃参数仅 5B,支持 256k 上下文窗口。该模型驱动 MDASH 在 CyberGym 基准测试中达到 95.95% 的准确率,展现了“小而专”的安全模型路线。

🔗 https://aihot.virxact.com/items/cms4fb2n603f4roeprjoopbix

AI Hot:火山引擎上线豆包搜索服务,为 Agent 提供实时搜索能力

火山引擎正式上线豆包搜索服务,为 AI Agent 提供跨语言、多模态、多垂类的联网信息查询。该服务建立权威分级体系,过滤低质信息,在 SimpleQA、FreshQA、BrowseComp-ZH 等评测中表现优异。支持 API、Skill、MCP 等多种接入方式,面向企业和开发者提供每月 500 次免费搜索额度。

🔗 https://aihot.virxact.com/items/cms4himl9047broepnobhk6n2

AI Hot:德里高等法院裁定 OpenAI 利用 ANI 内容训练 AI 未侵犯版权

德里高等法院认定 OpenAI 利用亚洲国际新闻(ANI)社的内容训练 AI 不构成版权侵权。法官 Amit Bansal 认为该行为符合印度《版权法》中研究类“合理使用”例外情形,且 ANI 未能证明 ChatGPT 直接复制其版权内容。法院同时指出,现阶段颁布临时禁令将不利于印度正在开发的 LLM 及大量免费用户。

🔗 https://aihot.virxact.com/items/cms4b9e8401zrroepw4fw8oka

播客精选

AI & I by Every:AI 应用下一波 — Chris Pedrigal(Granola CEO)

Chris Pedrigal 是 Granola 的联合创始人兼 CEO,Granola 是一款 AI 会议笔记应用,估值 $1.5B,团队约 55 人。在 Dan Shipper 的访谈中,他深度复盘了 AI 应用从第一波到下一波的转型。

创业从来都是刀战,无论成败。 Chris 坦言,他之前以为创业只有在不成功时才难,但 Granola 成功后他发现:“无论事情是否顺利,创业都是刀战,我对此毫无准备。”他之前在新闻学院学到的教训是:“这个世界最不需要的就是另一篇把成功人士描绘得轻松愉快的特写。”

AI 应用的第一波已经结束,第二波需要深度 Agent 集成。 Chris 认为,会议笔记只是 AI 应用的表层价值,真正的机会在于让 AI 理解会议上下文、跨时间追踪决策、自动执行后续行动。他用人体做类比:“AI 是韧带和肌肉,软件必须是骨骼——骨骼提供形态和结构,AI 围绕它灵活运作。”

传统岗位分工正在被 AI 重新定义。 Granola 团队(60-70 人)正在尝试消灭传统的 PM、设计师、工程师等头衔。Chris 认为真正的需求是:“在这个项目上,需要有人负责审美和用户体验,有人负责构建,有人负责策略,这些可以是同一个人,也可以是不同的人。”

协作界面的未来是 Agent 共在。 Dan Shipper 分享了他用 Codex 的经验:Codex 可以“进入文档”,设置存在状态和位置信息,让人类看到 Agent 在文档中的位置。Chris 认为协作工具需要让 Agent 知道“你的鼠标在哪里、你正在看什么”,这样 Agent 才能真正理解上下文。但挑战在于:Agent 可以同时执行上千个动作,如何向用户展示这些动作是一个巨大的 UI 难题。

🔗 https://www.youtube.com/playlist?list=PLuMcoKK9mKgHtW_o9h5sGO2vXrffKHwJL

X/Twitter 动态

Thibault Sottiaux(OpenAI Codex & ChatGPT):Codex 势头强劲,付费用户限额重置

OpenAI 的 Codex 和 ChatGPT Work 团队正在庆祝快速增长的采用率。Thibault 宣布所有付费用户的 Codex 和 ChatGPT Work 使用限额已重置,推文获得了 8,471 个赞和 477 次转发。他同时表示将短暂休息,预告“下周会很精彩”。

🔗 https://x.com/thsottiaux/status/2081940052154933696
🔗 https://x.com/thsottiaux/status/2081899343091843463


Guillermo Rauch(Vercel CEO):Grok 4.5 安全基准领先,Kimi 论文揭示 Agent 安全边界

Vercel 的最新安全基准测试显示,Grok 4.5 在性价比上成为最佳网络安全模型,比 Sol 便宜 10 倍,比 Opus 5 便宜 5.7 倍,比 GPT-5 便宜 2.2 倍。同时,Rauch 分享了 Kimi 的最新论文结论:容器级隔离不足以保护 Agent 运行环境,在实验中 Agent 直接导致宿主机崩溃。他强调:“Agent 需要正确的安全边界。”

🔗 https://x.com/rauchg/status/2081852481517318560
🔗 https://x.com/rauchg/status/2081842439304995169


Aaron Levie(Box CEO):AI 未导致就业下降,K3 权重已到

Box CEO Aaron Levie 观察到,AI 导致就业下降的预测并未成真。他接触的大量企业仍在招聘,只是岗位类型在向 AI 相关倾斜。同时他转发了 K3 权重的发布消息。

🔗 https://x.com/levie/status/2081930301752942703
🔗 https://x.com/levie/status/2081760710108012702


Peter Steinberger(OpenClaw):Agent 之间的自动化协作已经落地

Peter Steinberger 分享了一个里程碑式的 Agent 协作案例:他的 Agent 在深夜报了一个 bug,Jarred Sumner 的 robobun Agent 在同一晚就修复了。他评价道:“这是未来。”同时他提到,尽管团队做了大量安全工作,外界仍然认为他们“不安全”。

🔗 https://x.com/steipete/status/2081767828278170002


Peter Yang:Codex 使用体验——骑车时远程修复发布视频

Peter Yang 采访了 OpenAI DevEx 团队的 jxnlco,后者分享了 Codex 最疯狂的使用体验:“我在骑车时,同事让我修复一个发布视频。我用手机远程连接,让 Codex 完成了修复。”Peter 还写了详细的使用心得和提示词。

🔗 https://x.com/petergyang/status/2081775399097549083


Amjad Masad(Replit CEO):进入计算探索的新纪元

Replit CEO Amjad Masad 发表了一段充满哲思的推文:“我们的祖先绘制了地球地图,然后探索了太空。我们这一代人可能探索的是计算宇宙:算法、程序、证明和模拟的广阔空间。”他认为 AI 正在开启一个全新的探索时代。

🔗 https://x.com/amasad/status/2082000490066592127


Nan Yu(Linear 产品负责人):请把产品做好

Linear 的产品负责人 Nan Yu 简洁有力地表达了对产品品质的呼吁:“很多非常聪明的人非常努力地让产品变得好用。如果你有非常聪明的人,你应该让他们把你自己的产品也做得很好用。为此付出代价。”

🔗 https://x.com/nanyu/status/2081768780045156358


Nikunj Kothari(FPV Ventures):用 Claude Code 作为旅行主界面

Nikunj Kothari 在一次两周旅行中,将 Claude Code 作为主要操作界面,并在旅行结束后让 Claude Code 做了一次完整的回顾,分析可以改进的地方。

🔗 https://x.com/nikunj/status/2081992618649547100


数据采集时间:2026-07-28 23:58 CST

评论互动

© 2026 王若风的技术博客 · Powered by Astro