AI · 情报 · 路线图 · 判断
这里不是简单的信息堆,而是持续接收信号、整理主题、形成判断的工作台。
2026-10-03
把模型选择、推理强度、Prompt Caching、上下文压缩和长任务治理放进同一套生产框架。重点不再是“选最强模型”,而是优化任务成功率、延迟、缓存命中和人工复核共同构成的系统成本;缓存输入 token 最高可比未缓存便宜 95%。 链接...
2026-10-03
认为,随着 LLM 自主能力增强,人类工作的重心将从直接生产上移到监督与理解。他给出的实践路径很有启发:先要求模型使用 ASD STE100 等受控语言写作,再升级为图解、交互式 HTML,最终生成定制讲解视频。当智能和代码足够廉价时,即用...
2026-10-02
发布了面向分类、路由等 Agent 决策任务的开源平台 Clef,支持 64k 上下文和视觉输入。其域名分类测试耗时 2.2 秒,对比 gpt oss 120b 的 4.7 秒。这个信号说明:许多 Agent 步骤不需要调用昂贵的通用大模型...
2026-10-03
今天最重要的判断: AI 产品竞争正在从模型能力竞争,转向 Harness 与 Verification 的系统竞争。 OpenAI 的 GPT 6 生产指南把模型选择、推理强度、缓存和长任务治理放进一张成本表;Chatham 的交易验证案...
2026-10-02
今天最重要的判断:Agent 的最优形态不是“所有步骤都调用最强大模型”,而是把不同认知任务分配给不同成本、延迟和可靠性等级的组件。 Cloudflare Clef 与 LangChain 模型路由器提供了两组直接证据。前者说明分类、路由等...
2026-10-01
今天最重要的判断:AI 竞争正在围绕“Google DeepMind 发布 Gemini 4 Argon,面向可信网络防御者先行开放”这类信号继续向执行系统迁移。 从今天的情报结构看,主要信号覆盖了模型发布/更新、行业动态、论文研究、技巧与...
2026-03-20
最近我做了两个站点。 一个叫 AI 作 ,每天会从二十多个英文艺术信源里提炼出一份简洁的 AI 资讯,三五分钟就能看完。 另一个叫 AI 件报 ,每天会分析三百多篇 AI 论文,再把其中最值得看的几篇用更容易理解的方式呈现出来。 这两个站做...
2026-03-14
目标 :搭建一个真正能干活的 AI 团队,不是玩具,而是能 24/7 运行的协作系统。 成果 :本文将指导你搭建一个包含 4 个 Agent 的 AI 团队: Zen (首席参谋):协调、决策、日报 Muse (情报官):信息收集、研究分析...
2026-03-14
基于实战经验 + 橙皮书 + 社区实践总结的实用指南。 Tips : 先用 OAuth 登录(不要一上来就配 API Key) 等第一次成功跑通再加复杂配置 用 openclaw status 检查状态,比猜测更可靠 | 场景 | 推荐模型...