今天群里最重要的信号,不是“又有新模型”,而是 Agent 一旦开始触碰真实服务器,提示词里的约束就不够了。模型消息要核验,远程动作要限权,设计输出要有评价循环。
| 阅读入口 | 怎么读 |
|---|---|
| 0. 速览 | 先用长图抓住“核验—限权—验收”的主线。 |
| 1. 阅读入口 | 直接打开官方模型、工具与工程资料。 |
| 2. 项目雷达 | 看 Kimi 模型动态与 Kimi Code 的执行边界。 |
| 3. 话题雷达 | 带走远程部署护栏和设计评价循环。 |
| 4. 高质量内容与资源索引 | 查看外链状态、原始入口与本期价值。 |
0. 速览

本期判断:Agent 开始碰真实环境后,工作流要从“写清提示词”升级成“把边界写进权限、目录和验收”。
一句话:模型传闻等官方入口,部署动作过硬护栏,设计输出走可见的评价循环。
1. 阅读入口
https://platform.kimi.com/platform.kimi.comhttps://www.kimi.com/code/docs/en/kimi-code/whats-new.htmlwww.kimi.comhttps://www.kimi.com/code/docs/en/kimi-code-cli/customization/hooks.htmlwww.kimi.comhttps://openai.com/index/harness-engineering/openai.com2. 项目雷达
2.1 Kimi K3:先列入观察,不把传闻写成发布
群内转发“听说 Kimi K3 今晚上线”的小红书笔记后,很快出现关注。但截至 2026 年 7 月 15 日,Kimi 官方开放平台首页仍将 K2.7 Code 标为当前最强 Coding 模型,最新模型列表为 K2.7 Code、K2.6、K2.5,页面没有出现 K3。
资料补充:模型消息三步核验 先查官方首页与模型列表,再看控制台是否出现真实 model id,最后核对价格页与变更日志。三处没有形成闭环前,不急着迁移生产任务。
这条消息的价值更像一次提醒:快速变化的模型消息要分清“社区线索”“页面预热”和“可用发布”。具体可用入口以 Kimi 官方控制台与模型列表为准。
2.2 Kimi Code HighSpeed:速度提升后,执行边界更要硬
群友分享了一次远程部署事故:会话压缩上下文后,Agent 忘记已有约束,重新选择服务器目录、把文件传到错误位置,还修改了约束文档。问题不只是“记忆变差”,而是关键边界只存在于对话,没有被权限与执行机制托住。
Kimi Code 官方更新记录显示,HighSpeed 已于 7 月 9 日上线;工具文档同时说明,文件写入和 Shell 默认需要审批,YOLO 模式会跳过常规工具审批。对于真实服务器、生产目录和密钥相关任务,速度不应换走人工确认。
3. 话题雷达
3.1 远程部署:把“不要做”变成四道护栏
| 护栏 | 最小做法 |
|---|---|
| 固定目录 | 显式写出本地、上传和远端工作目录;执行前打印 pwd 与目标路径,路径不匹配就停止。 |
| 限制权限 | 使用单任务服务器或低权限账号;文件写入、Shell、重启服务保留人工审批。 |
| 分阶段部署 | 先上传到 staging,核对文件清单与 git diff,再原子切换;不要直接覆盖运行目录。 |
| 闭环验收 | 记录 commit、目标路径、重启结果和健康检查;异常时可按同一记录回滚。 |
工具补充:Kimi Code 支持在 PreToolUse 阶段用 Hooks 拦截 Shell 命令,但官方文档明确说明 Hooks 采用 fail-open,适合预警与轻量拦截,不应作为唯一安全边界。高风险操作仍需权限审批与人工确认。3.2 上下文压缩:约束要能在新上下文里重新加载
压缩不是偶发异常,而是长任务迟早会遇到的状态变化。关键约束至少保留三份:项目内可版本控制的执行说明、部署前机器可检查的路径/权限规则、每次操作后可追溯的变更记录。这样即使模型摘要遗漏信息,系统仍能把它挡在错误目录之外。
最小恢复块:目标目录、禁止目录、当前 commit、允许的命令、需要人工确认的动作、健康检查命令、回滚方式。每次压缩或换线程后,先重新读取并复述,再开始写入。
3.3 AI 设计:先建立评价循环,再追求“更好看”
群内分享“AI 为什么还不擅长设计”后,有成员把它对应到自己的产品 UI 体验:模型能完成界面,却像隔着一层窗户纸。该小红书正文完整展开了三层原因:代码可以通过编译、测试和功能结果形成明确反馈,设计还要考虑产品目标、用户语境、交互与视觉表达;模型更擅长复现已经流行的成熟风格,不等于理解文化变化或提出新方向;生成一个页面也不等于建立组件语义、视觉规则与代码结构相互对应的设计系统。
转发内容精选:Codex 负责人——AI 为什么还不擅长设计 作者林未知,发布于 2026 年 7 月 14 日。正文提醒:AI 可以直接做出可运行版本,但完成度越高,团队越容易误以为方向已经确定。设计师的价值会更集中在判断什么值得做,以及提出新的可能。 打开小红书原文
- 目标层:写清受众、场景、要解决的问题,以及本轮只验证什么;不要让完整原型替代方向判断。
- 方向层:提供参考与反例,说明希望保留和突破的风格、文化语境与差异化意图,避免只复刻流行分布。
- 系统层:明确设计 token、组件语义、交互状态和代码结构,让产品扩展后仍保持一致。
- 复测层:桌面与移动端固定视口截图,检查层级、对齐、密度、溢出与跨页面一致性;由人决定是否继续该方向。
OpenAI 的工程实践也强调,把人类判断编码成可重复执行的原则、反馈循环和控制系统。设计任务可以照搬这一思路:不要只追加形容词,而要让“什么算好”变得可观察、可复测。
3.4 WAIC 行程进入执行期:会场之外,先约具体同行
群里继续确认 18 日参会与世博、张江、徐汇等会场信息。上一期已经讨论过主会与 side event 的选场方法,今天更适合把它推进一步:明确当天所在会场、想见的人和可交换的项目,再约具体时间点;不要只停在“到时碰面”。
4. 高质量内容与资源索引
| 内容 | 平台 / 状态 | 本期价值 |
|---|---|---|
| Kimi K3 上线传闻 | 小红书;正文抓取受限 | 作为模型消息核验案例;不作为正式发布依据。 |
| Kimi API 开放平台 | 官方;已核验 | 核对最新模型列表、价格与可用入口。 |
| Kimi Code 更新记录 | 官方;已核验 | 确认 HighSpeed、上下文压缩与近期工具变化。 |
| Kimi Code Hooks | 官方;已核验 | 构造命令拦截;理解 fail-open 与人工审批边界。 |
| AI 为什么还不擅长设计 | 小红书;正文已完整抓取 | 评价、创新、系统与原型阶段判断四层方法。 |
| Harness engineering | OpenAI 官方;已核验 | 用原则、反馈循环和控制系统承接人类判断。 |
欢迎加入 IF.Linker AI 交流群,联系值班管理员加入。