AI Signals and Reality Checks

Daily expert AI briefing: signals, reality checks, and pragmatic strategy.
AI Signals and Reality Checks

AI 分发正迁入云承诺

AI 分发正在进入云承诺额度 重要的不是 OpenAI 又多了一条云渠道;重要的是,AI 模型采用正在被拉入既有云承诺额度之中,因为企业级分发现在不仅取决于模型质量,也取决于预算轨道。 6 月 10 日,OpenAI 表示 Oracle Cloud Infrastructure 客户很快可以通过 OCI 使用符合条件的 Oracle Universal Credits 来购买 OpenAI 模型和 Codex。Oracle 随后在 6 月 11 日用了同样的核心表述:组织将能够通过既有 OCI 账户、计费、采购流程、治理框架和云投资来访问 OpenAI。这不是一次模型发布。也正因为如此,它才重要。 最容易的解读是采购摩擦。大型公司购买 AI 的方式,通常不是像开发者注册一个
7 min read
视觉搜索正成为智能体记忆
AI Signals and Reality Checks

视觉搜索正成为智能体记忆

视觉搜索正在变成智能体记忆 重要的不是网页搜索可以返回图片;重要的是,智能体开始需要把视觉证据纳入自己的工作记忆,因为许多真实任务依赖的是用户通过视觉识别的东西,而不只是能够用文字准确表达的事实。 OpenAI 6 月 9 日的 API 更新日志记录了一个看似很小的功能:Responses API 中的网页搜索现在可以在常规文本结果之外返回图片结果,适用于需要当前视觉信息或有网页依据的视觉信息的场景,例如产品照片、地标、地点、事件或视觉参考。单独看,这像是搜索能力的改进。更尖锐的解读是:视觉检索正在成为智能体运行时的基础能力。 这不是为了让聊天答案更好看,而是为了弥合用户识别世界的方式和 LLM 系统检索世界的方式之间的缺口。用户可能不知道一把椅子的型号、一栋建筑的名字、一款产品的准确版本,或某个公共事件的正式标题。他们可能指着一张照片、描述一个形状、问“带绿色标签的那个”,或者用视觉方式比较两个商品列表。文本搜索能帮忙,但它经常丢掉真正让任务变具体的区分特征。 这里的核心机制是“视觉 grounding 缓存”。在严肃的智能体工作流中,图片结果不应该被当作装饰附件。它们应该成
7 min read
AI 的新产品是权限层
AI Signals and Reality Checks

AI 的新产品是权限层

新的 AI 产品,是权限层 重要的不是 Anthropic 发布了一个更强的模型;重要的是,同一套底层能力正在通过不同的权限层被包装和分发,因为前沿 AI 的分发正在变成一个“信任路由”问题,而不再只是简单的 API 可用性问题。 Anthropic 在 6 月 9 日发布 Claude Fable 5 和 Claude Mythos 5,表面上看是一则熟悉的前沿模型公告:更强的代码能力、更强的知识工作能力、更好的视觉、更持久的长上下文、客户评价、基准比较,以及新的价格。标题数字很容易被转述。根据 Anthropic 的说法,Fable 5 和 Mythos 5 的价格是每百万输入 token 10
7 min read
AI Signals and Reality Checks

推理正成为路由问题

推理正在变成一个路由问题 重点不在于 AI 实验室和云厂商正在寻找 Nvidia 的替代方案;重点在于,推理正在变成一个工作负载路由问题,因为内存带宽、功耗边界、封装产能、延迟目标和软件支持,正在决定哪些模型调用在经济上可行。 最新信号不是某一个单独公告,而是一组信号同时出现。5 月 21 日,AMD 宣布将在台湾产业生态投入超过 100 亿美元,用于扩大策略合作伙伴关系,并提升面向 AI 基础设施的先进封装产能,其中包括 Helios 机架级平台和 Instinct MI450X 的部署计划。同一天,AMD 还宣布下一代 EPYC “Venice” CPU 已经在台积电 2 纳米制程上进入量产爬坡,并明确把 CPU 描述为 AI 数据移动、网络、存储、安全和系统编排的协调层。
7 min read