← 全部专辑

持续更新 · 47 期

每日关注流

全部内容

按发布时间倒序
8 月 13 日:模型更强之后,成本、协作与验收更重要
文章

8 月 13 日:模型更强之后,成本、协作与验收更重要

DeepSeek V4 Pro 将模型发布、Responses API 与峰谷定价放在一起;multi-agent 研究、Software Factory、跨平台开发和浏览器 Agent 安全提醒则说明,能力进入真实工作流后,协作机制、单位任务成本、测试验收和权限边界会决定系统能否稳定使用。

从生成代码到重写软件:Agent 落地的真实成本
文章

从生成代码到重写软件:Agent 落地的真实成本

今天的关注流里,AI 已经出现重写利基闭源组件的真实案例;企业 Agent 仍需要 FDE、持续评测和流程改造,模型水印、凭证信任与 system prompt 传递又把治理问题带进了日常工作。真正决定效率的,是验收、交付和控制能力。

Agent 的成本与控制边界,开始从工具层进入组织层
文章

Agent 的成本与控制边界,开始从工具层进入组织层

今天的关注流给出两组互相校正的信号:Agent 的安全边界正在进入授权、工具协议和网络出口;真正落地时,内部平台、模型路由、Token 成本、review 负担与组织结构又会决定效率。开放模型和 Agent 文件工具继续往可部署的工作流靠近。

2026-08-10:开放模型开始接上 Agent 基础设施,验证成本也在上升
文章

2026-08-10:开放模型开始接上 Agent 基础设施,验证成本也在上升

Meta 的 Muse Glimmer、MiniMax H3 的社区适配、Hermes 的工具工程和 Qwen 的多模态 harness,显示开放模型正在进入可执行的 Agent 基础设施。与此同时,Linear 的失败反馈、预约 API 漏洞和代码 review 成本提醒我,真正难的部分仍是验证、权限与长期维护。

2026-08-09:Agent 进入真实工作流后,细节开始决定结果
文章

2026-08-09:Agent 进入真实工作流后,细节开始决定结果

今天的关注流从权限模式、成本控制和配额管理,延伸到模型入口、开源路线、桌面控制和真实任务成本。Agent 的能力展示越来越容易,真正值得跟踪的是它能否被验证、计价、授权,并在长期使用中保持可维护。

2026-08-08:Agent 开始进入可验证的成本与风险边界
文章

2026-08-08:Agent 开始进入可验证的成本与风险边界

策略实验、长任务验证、模型价格性能、云端隐私和真实资金演示同时出现。今天更值得记住的是,Agent 的价值开始取决于实验能否复现、成本能否控制、权限能否收回,单纯展示模型能力已经不够。

2026-08-07:AI 工具开始进入真实工作流
文章

2026-08-07:AI 工具开始进入真实工作流

今天的关注流里,Agent 插件、PR 安全审查、可调推理、网页操作和企业运营代理同时出现。模型能力也开始用事实性、竞赛结果和真实业务场景来验证。

2026-08-06:AI 开始进入组织、应用与评测三层
文章

2026-08-06:AI 开始进入组织、应用与评测三层

AI 的变化开始具体体现在三处:资深工程师成立新公司探索自动化科学,Cloudflare 用隔离应用实例承载可修改软件,Hermes Agent 把本地文件、记忆和推理资源串成一套能力;模型事实性榜单、开放权重视频结果与低价调用入口,也让工具选择更接近真实的成本和边界。

2026-08-05:Agent 开始进入组织,工作流问题更具体了
文章

2026-08-05:Agent 开始进入组织,工作流问题更具体了

今天的关注流从模型发布延伸到真实工作流:安全评估要看权限和隔离,企业仍在试验模型、身份与数据访问的组合,个人也开始把编排、执行和验证分层。

模型发布开始进入部署边界的细节
文章

模型发布开始进入部署边界的细节

今天的信息一半在讨论 agent 的长期运行与可验证性,另一半已经落到更具体的部署条件:Qwen3.8-Max 进入第三方路由,MiniMax-H3 需要按区域许可,Kimi K3 的多轮工具调用要求保留完整模型消息。个人 agent 也开始接入 iMessage、日历等高频入口,权限和人工确认随之成为产品的一部分。

开放模型开始把能力、接口和部署放在同一天交付
文章

开放模型开始把能力、接口和部署放在同一天交付

Qwen 发布 Qwen3.8-Max 与 Qwen-CUA,分别覆盖长程 coding 和图形界面操作;MiniMax-H3 公开权重后迅速接入本地与 OpenAI 兼容视频推理。早报里的 Hermes、Vercel 和远程开发配置也说明,agent 的价值开始取决于长期运行、明确接口与可验证任务。

2026-08-02:Agent 的能力开始需要更具体的验收与授权
文章

2026-08-02:Agent 的能力开始需要更具体的验收与授权

Agent 正进入可观察的工作界面、硬件测试和告警修复闭环;长程生成、开源协作、视频编辑和 AI 写作同时要求更清楚的验收、授权与编辑责任。