文章
个人写作优先,自动整理的内容仍可按需查看。

2026-06-27:模型准入、调试层和 Hermes 运营地基一起变硬
今天的关注流从 `GPT-5.6` 的分层限流一路推进到 `Claude Mythos 5` 的局部恢复,同时把 `observability`、`verification` 和 `Hermes` 的运行层一起抬了出来。比起某个模型又更强,今天更值得记的是 access、debugging 和 agent 运营地基开始同时变硬。

2026-06-27:AI 开始长出更具体的使用表面
今天最有意思的几条样本,不是继续做更大的 AI 工作台,而是开始长出更明确的使用表面:一键切换的 UI variation、单目实时 3D 感知、开源 teleoperation 控制层,以及团队消息入口里的 open agent interface。

2026-06-26:Agent 开始长到真实操作表面
今天的关注流把一条线讲得更清楚了:Agent 不只是继续变强,而是开始同时长出执行壳、验证壳和准入壳。上午是远程执行、ambient 协作和更严格 eval,晚上则把这条线推进到浏览器任务、QA 闭环、模型准入和维护成本。

2026-06-26:AI 开始长出更小的交互壳
今天最有意思的几条样本,不是更大的 AI 工作台,而是更小、更具体的交互壳:本地小模型生成可玩界面、iPhone 离线抽取、桌面 companion,以及更贴近真实 QA 的 app 测试 agent。

2026-06-25:Agent 同事开始落进共享工作流
今天的关注流把同一件事往前推了一步:Agent 不再只是个人对话窗口里的助手,而是开始进入共享任务板、群聊、例行流程和真实工具链。真正值得注意的不是又多了一个入口,而是身份、权限、审计、预算、工作流公开化和模型成本这些“能不能长期跑”的问题开始同时浮出水面。

2026-06-25:AI 实验样本开始从浏览器工作壳走向真实世界接口
AI 实验样本正在从屏幕里的应用生成,继续往两端延伸:一端是更完整的 agent browser 和多模态 QA 闭环,另一端是 3D 打印、小硬件和真实世界监控。值得看的不是单个 demo 多炫,而是 AI 输出正在接上更具体的执行壳和物理反馈。

2026-06-25:Agent 工作流里的身份、权限与模型路由
Agent 进入真实工作流后,身份、权限、审计、撤权、成本和可持续运行会先变成瓶颈。Notion、Cursor、Claude Managed Agents、Hermes、OpenAI 和模型路由相关信息,都指向同一个变化:Agent 产品正在从能力展示转向可运行的工作流基础设施。
