← 返回雷达列表

2026-07-17—2026-07-22 IF.Link 社区雷达|从模型竞速到现实入口,AI 开始进入工作、现场与生活

社区雷达

五天群聊串起了一条完整路径:先比较 Kimi K3、Codex 与 Gemini 的能力和成本,再把 Agent 放进工作台;随后,机器人、语音、智能体手机、AI 创作活动与模型验真,把讨论从“模型有多强”推进到“它能否稳定完成现实任务”。

阅读方式:这是一份覆盖五个连续聊天窗口的单期雷达。正文按时间线呈现信号演进,再把方法和来源统一收束。

阅读入口怎么读
0. 速览先看长图与本期总判断。
1. 阅读入口打开正文信息量最高的原始来源。
2. 项目雷达按 7 月 17 日至 21 日的时间线理解信号演进。
3. 话题雷达带走模型复测、Agent、机器人、语音与验真的方法。
4. 高质量内容与资源索引核对 14 个群聊入口、官方页面与论文。

0. 速览

本期判断:选 AI 工具不能只看一次惊艳 Demo。真正影响使用的是单位成功成本、权限边界、失败恢复、跨场景稳定性,以及能否留下可复测的证据。

五天群聊串起了一条完整路径:先比较 Kimi K3、Codex 与 Gemini 的能力和成本,再把 Agent 放进工作台;随后,机器人、语音、智能体手机、AI 创作活动与模型验真,把讨论从“模型有多强”推进到“它能否稳定完成现实任务”。

1. 阅读入口

如果只读六个入口,建议依次看 Kimi K3、TRAE Work、SkillPay、WAIC、MossLand 与智能体手机;模型验真原论文放在资源索引中。

https://www.kimi.com/help/agent/agent-overviewwww.kimi.com

核验 K3 的视觉、长上下文、Agent 与产品入口。

https://forum.trae.cn/t/topic/168808forum.trae.cn

补充内置模型与自定义接口适配讨论。

https://jishuzhan.net/article/2078055939012960257jishuzhan.net

包含安装、定制、验证、恢复及安全提醒。

https://developer.cloud.tencent.com/article/2710637developer.cloud.tencent.com

核验付费技能上架、调用、支付和首批场景。

https://d.biji.com/GNCJJDoaBira9Ased.biji.com

论坛资料、报告与笔记的持续更新入口。

https://www.xiaohongshu.com/discovery/item/6a50d1dc0000000021023bd5www.xiaohongshu.com

作为低声交互线索,参数不做扩写。

2. 项目雷达

2.1 07.17|模型能力变强,任务经济账先浮出水面

群聊从 Kimi K3 与 GLM-5.2 的体验对比开始。K3 的网页复刻和前端生成获得肯定,但长历史读取、Agent 长程执行和订阅额度消耗也迅速成为焦点。官方资料显示 K3 原生支持视觉和 100 万 token 上下文,并进入 Kimi Agent、Work、Code 与 API;这意味着比较模型时,应把交付质量与完整任务成本放在一起看。

  • TRAE 中国版很快接入 Kimi-K3;正文镜像还记录了自定义接口适配问题。
  • TRAE Work 换肤教程不只讲视觉:安装、定制、验证、恢复四个入口构成了可逆的本地改造流程。
  • Codex 推理强度形成实用分档:路径明确直接执行;陌生系统、并行探索或高风险审计再升档。
  • 腾讯 SkillPay 把技能分发、Agent 调用和支付接起来,也把交付定义、失败处理和付款确认推到台前。

2.2 07.18—07.19|WAIC 现场:机器人从“会动”走向“会反馈”

群友用大量图片、视频和现场描述记录了足球、舞狮、握手、跌倒恢复、拟真面部与家庭任务。最重要的现场判断不是动作更炫,而是感知、决策、失败恢复和连续交互开始同时出现。群里还补充了首形相关展示与智元展位线索,公开信息显示双方参与成立“智形未来”,组合方向指向高拟真表达与运动控制协同。

  • 五层观察法:本体、感知、决策、恢复、交互;每层都区分单次演示和连续运行。
  • 共享 WAIC 知识库把论坛资料、报告、录音笔记和现场侦察汇到同一入口。
  • 展会复测应主动记录失败、重试和环境变化,避免只留下“现场很震撼”。

2.3 07.19|语音成为低打扰入口,也成为完整内容工作流

群里转发了公共场所低声办公和模思语音模型的内容,并在 WAIC 现场确认模思展位。MossLand 官方正文显示平台覆盖 TTS、音色库、多语言配音、多人转写、音视频生成与数字人。语音产品的判断重点正在从“像不像某个人”转向角色一致性、长文本稳定、情绪控制、环境噪声和授权边界。

  • 低声办公要同时测近讲拾音、噪声、隐私和连续指令准确率。
  • 声音生成要做连续多段、情绪切换和长文本漏字测试,不能只听一条样例。
  • “万物开口计划”把这套能力变成声音人格创作:选对象、定人格、写台词、生成多版、放进具体场景。

2.4 07.19—07.20|AI 从产品展示进入手机、学习活动与创作现场

NaviX Ultra 把智能体手机的卖点推向跨应用任务执行;群里同时发起 IF.Link × Datawhale 面向准大学生的南京 AI 学习活动,并分享 AI 恐怖片黑客松。三个信号共同指向“端到端任务”:手机要安全办完事,课程要让零基础完成真实作品,黑客松要把脚本、分镜、声音、视频与剪辑接成生产线。

  • 智能体手机验收:权限逐步确认、敏感操作拦截、失败回滚、操作日志。
  • “领学一夏·南京”覆盖对话、调研写作、知识库、PPT、图片、智能体和 AI Coding,并招募课程测试、助教、运营与组织共创。
  • AI 恐怖片黑客松用 12 小时短片任务检验多工具协同,而不是只比单张效果图。

2.5 07.20—07.21|Gemini 3.6 Flash 发布,群聊把新模型拉回同题复测

时间窗末,群里从截图追问“为什么是 3.6 Flash、3.5 Pro 发了吗”。Google 7 月 21 日官方发布 Gemini 3.6 Flash,并将其放在编码、多模态、知识工作和 Agent 场景中;3.5 Pro 当时仍处于合作伙伴测试。真正有用的做法不是追版本号,而是固定任务比较完成时间、token、工具调用、返工次数和最终质量。

  • 截图适合作为新动向提醒,上线状态以官方模型页和控制台为准。
  • 速度更快或单价更低,不代表单位成功成本一定更低。
  • 同题复测要保留提示词、输入、配置、失败记录和最终交付物。

2.6 07.21|随机数变成模型指纹,但“照妖镜”不是问一次 42

群里转发了“AI 说不出的随机数”,并马上联想到测试中转站。原论文对 165 个模型做跨语言单词探测,把随机数字、颜色、动物等回答的经验分布当作行为指纹;40 个探测单元的等错误率为 7.3%,8 个探测单元约 10.6%。它适合发现路由或版本变化,但不是一次提问就能完成的密码学验真。

  • 先用同日官方 API、相同模型和采样参数建立可信基线。
  • 重复采样后计算分布距离,再输出“相符、异常、证据不足”三态。
  • 若结果影响采购或安全,还要结合供应商证明、性能基准和请求日志。

3. 话题雷达

3.1 模型复测矩阵

同题比较前端还原、仓库理解、长程稳定、工具执行、返工次数和最终成功成本;第二轮允许复用缓存与交接包。

3.2 Agent 任务经济账

分别记录历史读取、实际执行、人工接管、失败重试和最终成功交付;不要只看订阅价格或单次 token 单价。

3.3 具身智能五层表

按本体、感知、决策、恢复、交互拆解 Demo;每项同时收集成功片段、失败片段和连续运行证据。

3.4 声音人格五步法

选对象 → 写人格矛盾点 → 写一句专属台词 → 生成三种情绪版本 → 放入 15–30 秒具体场景。

3.5 智能体终端四步验收

给跨应用任务 → 观察授权 → 主动制造异常 → 检查暂停、解释、回滚与日志。

3.6 模型端点统计审计

固定配置 → 选择一词任务 → 重复采样 → 建立经验分布 → 与官方基线计算距离 → 异常端点复测。

4. 高质量内容与资源索引

内容入口正文价值读取状态
Kimi K3 / Agent 官方说明打开核验 K3 的视觉、长上下文、Agent 与产品入口。已读取官方正文
TRAE 支持 Kimi-K3打开补充内置模型与自定义接口适配讨论。已读取可检索正文
TRAE Work 换肤教程打开包含安装、定制、验证、恢复及安全提醒。已读取正文镜像
腾讯云 SkillPay打开核验付费技能上架、调用、支付和首批场景。已读取腾讯云正文
WAIC 共享知识库打开论坛资料、报告与笔记的持续更新入口。群内直链;页面读取受限
公共场所小声办公打开作为低声交互线索,参数不做扩写。小红书正文受限
首形科技打开高拟真情感交互机器人入口。已核验官方页面
智元机器人打开通用具身平台与部署方向。已核验官方页面
MossLand打开TTS、音色、配音、转写、音视频和数字人。已读取官方正文
NaviX Ultra WAIC 报道打开跨应用任务规划与智能体手机入口。已核验公开报道
第一届 AI 恐怖片黑客松打开12 小时短片、工作坊和多工具内容生产。已读取活动正文
万物开口计划打开声音人格挑战赛主题、奖项和参与入口。公众号受限;群内公告完整
Gemini 3.6 Flash 官方发布打开核验发布日期、定位及 3.5 Pro 状态。已读取 Google 官方正文
One Token Is Enough打开模型指纹方法、165 模型、EER 与使用边界。已读取原论文摘要与实验结果

欢迎加入 IF.Linker AI 交流群,联系值班管理员加入。