← 返回雷达列表

2026-06-18 IF.Link 社区雷达

社区雷达
日期:2026年6月19日 这份文档整理 IF.Linker AI 交流群首日讨论中值得留下的想法、方法和项目。 信息图负责快速扫一眼,这份文档负责把内容讲清楚:读完后,可以带走几个判断,复用几套流程,顺手打开几个项目继续看。

0. 速览

1. 阅读入口

这一天最值得留下来的,是几类可复用的内容:

方向可以带走什么
模型鉴别用 tokenizer、特殊 token、响应特征判断模型入口是否稳定
Agent 编排把长任务拆成 milestone,让执行、审计、交接变得可控
Coding 工具选择按任务类型选 Kimi、Codex、Trae、Grok、Gemini、Fable 等工具
小模型识图把图像题面转成结构化文本,再交给推理模型处理
校园本地工具用 OpenWrt、ZeroOmega 等方案降低网络和环境配置成本
项目展示从校园网关、求职工具、搭子匹配到小游戏,看到同学正在做的东西

下面的引用块是资料补充,用来给群聊话题补上下文和项目链接;群内经验和外部资料会分开写,避免把体验当成定论。

2. 项目雷达

2.1 SEU-OpenWrt-Gateway

https://github.com/YunfanGoForIt/SEU-OpenWrt-Gatewaygithub.com

SEU-OpenWrt-Gateway 是面向东南大学 SEU\-WLAN 的 OpenWrt 校园网关方案。它把 OpenWrt 路由器作为稳定上游终端,给电脑、手机、平板、游戏机、开发板等多设备共享校园网,并覆盖 portal 自动登录、wwan 自恢复、校园 DNS 分流与 OpenClash 协同。

项目补充 README 给出的典型拓扑是 SEU\-WLAN \-\> OpenWrt 路由器 \-\> 个人设备,核心脚本包括 seu\_login\.shwwan\-healthcheck\.shseu\_dns\_sync\.shopenclash\-auto\-node\.lua99\-openclash\-autostart。文档还专门写了让 Claude Code / Codex 这类 coding agent 帮忙部署的流程:先只读检查路由器状态,再上传脚本、配置 cron、验证 portal 探针和 OpenClash 状态。 参考:SEU-OpenWrt-Gateway GitHub部署指南故障排查安全与脱敏

2.2 HR / 求职主理人

https://github.com/Jaydenlk/HRgithub.com

HR / 求职主理人 不只是一个“校招小平台”,README 里明确写成中文校招/实习求职 AI 工具。它包含 Claude Code 插件和 Coach Web 内测版,主线原则是“句句有据、绝不编造、信息不足就承认”。

项目补充 项目覆盖约 40 种求职意图和 37 个工具,分成核心推理、求职执行、面试准备、市场情报、职业规划五层;知识资产包括 90 个细分职业 × 双难度档校招评分标尺,以及 600 家公司知识图谱。Coach Web 版还强调确定性护栏,例如时间线勾稽、可疑数字禁背书、防编造溯源。 参考:HR GitHubClaude Code

2.3 搭子SEU

https://www.daziseu.comwww.daziseu.com

搭子SEU 是东南大学校园连接/匹配平台。首页标题是“搭子SEU|找到校园里共鸣的伙伴”,群聊里介绍它用于东大学生搭子匹配,每周匹配、每周五揭晓。

项目补充 公开可访问页面显示项目定位为东大校园内的伙伴匹配服务;子任务检索到的关于页信息显示,它受 Date Drop、SJTU Date、Ditto 等校园匹配产品启发,目标是帮助东大学生认识对象、饭搭子、学习搭子等不同类型的校园伙伴。当前搜索引擎没有抓到更多可靠介绍,因此这里以官网标题和群聊补充为准。 参考:搭子SEU搭子SEU 关于页

2.4 技能五子棋

群里提到的技能五子棋,是把经典五子棋加入技能机制的轻量网页游戏方向。它的价值不在规模,而在“经典规则 + 一点机制变化”很容易玩、容易展示,也容易继续聊 AI 对手、技能平衡和在线试玩。

项目补充 公开搜索到的同类开源项目包括 Louis-7/jineng-wuziqi 及其 GitHub Pages 演示,README/规则文档描述其为 “Gomoku + Cards”:在 15×15 五子棋基础上加入抽牌、出牌、弃牌和技能卡机制。另一个 txzf42/SkillGoBang 使用“气”“韧性”“失衡”“终结技”等机制重构胜负流程。 参考:jineng-wuziqi GitHubjineng-wuziqi DemoSkillGoBang GitHub

2.5 ZeroOmega 教学文档

https://github.com/zero-peak/ZeroOmegagithub.com

ZeroOmega 这部分出现在校园网络和规则配置讨论里。它属于浏览器侧代理/规则配置工具,适合只需要在浏览器里管理访问规则的人:安装轻、改动小、见效快。

项目补充 ZeroOmega 是 SwitchyOmega 的 Manifest V3 兼容分支,README 写明它可以快速管理和切换多个代理配置,支持 Chrome Web Store、Microsoft Edge Addons 和 Firefox Addon。项目也声明没有独立官网,官方信息以 GitHub 和 wiki 为准。 参考:ZeroOmega GitHubChrome Web StoreFirefox Add-onSwitchyOmegaBackup 中文配置教程

3. 话题雷达

3.1 GLM 5.2、tokenizer 与模型路由观察

群聊里聊到了什么:大家从 GLM coding plan、火山版 GLM 5.2、OpenCode 多上游聊到一个更具体的问题:同一个模型名背后,实际调用的是否是同一个模型、同一套 tokenizer 或同一条服务链路。群里提到的 PoC (Polluted Chinese)token 是“锅内倒入植物油烧热”。它的价值不在于一句话证明“谁是不是原版”,而在于提供了一种观察模型入口行为的办法。

可按这套轻量流程检查:

  1. 记录入口信息:模型名、服务商、调用方式、测试时间、套餐或 API 版本。
  2. 准备测试样本:特殊 token、长上下文、代码任务、中文细节理解、固定 prompt。
  3. 观察行为差异:是否能识别 token,是否出现截断,是否有缓存痕迹,输出风格是否突然变化。
  4. 结合成本和延迟:同样任务下比较响应速度、价格、可用额度、失败率。
  5. 保留证据:保存 prompt、截图、返回结果和时间,避免凭印象讨论。
资料补充:GLM-5.2 的公开资料 Z.ai / 智谱开源资料将 GLM-5.2 定位为面向 long-horizon tasks 的旗舰开源模型,重点包括 1M token 上下文、coding effort 调节、MoE 架构、IndexShare sparse attention 和改进的 MTP speculative decoding。 参考:Z.ai GLM-5 GitHubHugging Face GLM-5.2GLM-5.2 config.jsonModelScope 介绍

可以直接带走的判断:特殊 token 测试适合做“粗筛”和“异常提醒”,不适合直接下判决。模型服务会变化,同一入口在不同时间、账号、负载或套餐下可能表现不同。

3.2 多 Agent 编排:从 subagent 到动态审计

群聊里聊到了什么:核心问题是“如何让 AI 长时间做事,还能收得回来”。大家讨论了 A2A、MCP、subagent、skill、milestone、reviewer、auditor,以及“蒸馏 Agent”。最有价值的结论很朴素:多 Agent 的重点不是开很多 agent,而是让目标、分工、验收、交接和停止条件足够清楚。

一个好的多 Agent 工作流,至少要回答五个问题:

问题需要写清楚的内容
做什么最终交付物、边界、不做什么
谁来做planner、worker、reviewer、auditor 各自负责什么
做到哪一步算完成milestone、验收标准、可运行测试、截图或文档证据
出错怎么办回滚策略、重试上限、人工接管点
怎么省成本token 预算、上下文压缩、缓存、阶段性总结

最小可实践版本:

  1. Planner:把任务拆成 3-5 个 milestone,每个 milestone 都写明输出物。
  2. Worker:只执行当前 milestone,不提前展开无关任务。
  3. Reviewer:检查是否满足验收标准,重点找 bug、遗漏和过度实现。
  4. Auditor:在关键节点做反向审计,专门质疑方案假设和风险。
  5. Human gate:每隔一段时间或每完成一个大节点,由人决定继续、改向还是停止。
资料补充:A2A 与 Claude Code Subagents Google 在 2025-04-09 发布 Agent2Agent Protocol,定位为开放的 agent 互操作协议,让不同厂商和框架构建的 agents 能发现彼此、交换信息、协同行动;核心机制包括 Agent Card、任务生命周期、消息和 Artifact,并使用 HTTP、SSE、JSON-RPC 等现有标准。2025-06,Linux Foundation 接管 A2A 项目,强调中立治理和安全互操作。Claude Code 官方文档则把 subagents 定义为特定任务型 AI 助手,每个 subagent 有独立上下文窗口、自定义 system prompt、工具权限和权限模式,适合把搜索、日志、文件阅读等高噪声支线从主会话隔离出去。 参考:Google Developers Blog: A2ALinux Foundation A2A 项目Claude Code Subagents

“蒸馏 Agent”怎么理解:这里指的是从高质量历史交互里提炼决策偏好、检查标准和输出格式,再写成 agent 预设。比如审计 agent 继承 code review 标准,设计 agent 继承品牌视觉规范,PM agent 继承需求拆解习惯。

3.3 Coding 工具选择:Kimi、Codex、Trae、Grok、Gemini、Fable

群聊里聊到了什么:这场讨论没有做正式 benchmark,更多围绕真实任务里的工具选择展开。大家关心的是“我现在到底拿它干什么”:Kimi 适合云端 agent 和文档交付,Codex 适合代码和仓库任务但视觉需要约束,Trae 是免费资源和活动入口,Grok 被期待用于搜索和 coding,Gemini 是长上下文与通用体验观察,Fable 则集中在生成游戏和复杂任务能力上。

工具群聊里的使用场景写进知识库时的边界
Kimi作业整理、端到端生成、LaTeX/PDF 输出省心,但关键答案仍要抽检
Codex代码修改、仓库内任务、课程/工程任务前端审美要给参考图和明确规范
Trae免费额度、活动资源、快速尝试可作为低成本入口,也注意隐私争议
Grok信息检索、agentic coding 期待区分已上线功能和社区期待
Gemini长上下文、通用任务、CLI/agent 体验版本体验会波动,记录具体场景
Fable生成游戏、复杂项目推进、视觉/代码 demo公开资料以媒体报道为主,暂未检索到官方页面
资料补充:工具公开定位 OpenAI 官方把 Codex 定义为 cloud-based software engineering agent,每个任务运行在隔离云沙箱中,可读写仓库、运行测试并返回日志证据。Trae 官网将 TRAE IDE 定位为 AI coding engineer,但也有媒体报道遥测与数据收集争议,引用时应标注为待核。xAI 文档显示 Grok API 支持 function calling、parallel function calling、Web/X Search,并列出 grok\-build\-0\.1 为面向 agentic coding workflows 的模型。Gemini CLI 官方仓库把它定义为开源 AI agent,支持代码库查询编辑、shell、web fetch/search、MCP、GEMINI.md 和 checkpointing。 参考:MoonshotAI/Kimi-K2Kimi 官网OpenAI CodexCodex HelpTrae 国际官网Trae 中文官网TechRadar Trae 争议报道xAI Function CallingxAI ModelsGemini CLI
资料补充:Fable 资料边界 目前没有检索到 Anthropic 官方 Fable 5 页面;公开信息主要来自媒体报道和视频搬运。媒体称 Fable 5 面向长周期软件工程、视觉理解、游戏生成和复杂任务,也提到高风险请求 safeguards、下线或受限等情况。放在这份雷达里,它更适合作为“群内关注的前沿案例”,暂不写成稳定可用的生产工具。 参考:Business InsiderTom’s Hardware 发布报道Tom’s Hardware 下线报道Bilibili 实测搬运

3.4 小模型识图:把物理卷子变成可推理文本

群聊里聊到了什么:一个很具体的例子是用小模型读物理卷子。这里的小模型不一定要直接解题,它可以先把图片里的题干、公式、图形关系整理成结构化文本,再交给更强的推理模型处理。

物理题识图的难点,不只是 OCR 识别文字。真正麻烦的是图像里的坐标轴、磁场方向、电流方向、点位关系、样品尺寸、公式符号和图注。小模型如果能把这些内容稳定转成文字,就已经完成了很有价值的中间层工作。

可复用流程:

  1. 输入图片:尽量保证清晰、无遮挡、题号和图完整。
  2. 要求结构化输出:分成“题干原文、公式整理、图形关系、已知量、要求量”。
  3. 要求保留不确定性:看不清的地方标注“无法确认”,不要让模型硬猜。
  4. 交给推理模型:把结构化文本复制给更强的模型做解答。
  5. 人工复核图形理解:重点检查方向、单位、坐标和数值。
text
请把这张物理题图片整理成可复制给推理模型的文本。
输出:
1. 题干原文
2. 已知量与单位
3. 图形关系说明
4. 公式或符号
5. 需要求解的问题
如果图片中有看不清或无法确认的信息,请明确标注,不要自行补全。
资料补充:Qwen 视觉模型上下文 公开资料里,Qwen3.6 已经是 Qwen model family 的更新入口,官方仓库说明它在 Qwen3.5 基础上继续强化 agentic coding、仓库级推理和 thinking preservation;Qwen3.5 则引入统一视觉语言基础,早期融合多模态 token,在推理、coding、agent 和视觉理解基准上超过 Qwen3-VL。阿里云 Model Studio 文档也把 Qwen3.5-Plus 归入多模态模型,支持文本、图像、视频输入,并强调视觉推理相对 Qwen-VL 系列有明显提升。闭源服务端版本更新更快,写作时要以百炼 / Model Studio 控制台和最新官方模型页为准。放到物理题识图场景里,较稳的做法是按“最新模型页与控制台可用入口 -\> 小尺寸或服务端多模态模型 -\> 结构化输出 -\> 强模型复核”来选。 参考:Qwen3.6 GitHubQwen3.5 Hugging FaceQwen 文档Alibaba Cloud Model Studio

3.5 校园网与本地工具:OpenWrt、ZeroOmega 与规则配置

群聊里聊到了什么:AI 工具体验不只取决于模型,也取决于网络、设备和环境配置。校园网、东大云盘、CVS、GPT 等场景之间切换不便,所以大家聊到了 OpenWrt、ZeroOmega、TUN 和规则分流。

https://github.com/YunfanGoForIt/SEU-OpenWrt-Gatewaygithub.com
场景优先考虑适合谁
只想管理浏览器访问规则ZeroOmega单设备、轻量需求、希望快速上手
宿舍多设备接入和网络管理OpenWrt 路由器方案设备较多、愿意维护路由器配置
系统级流量规则TUN / 规则配置有一定网络基础、需要更细控制
校内资源与外部 AI 服务切换规则分流与白名单经常在 CVS、东大云盘、AI 服务之间切换
资料补充:OpenWrt 与 ZeroOmega OpenWrt 是面向嵌入式设备的 Linux 操作系统,核心价值在于可写文件系统、包管理和可定制路由/网络能力。ZeroOmega 是 SwitchyOmega 的 Manifest V3 兼容分支,用于在浏览器内快速管理和切换多个代理配置,支持 Chromium/Firefox 扩展;其 README 声明目前没有独立官网,官方信息以 GitHub 项目和 wiki 为准,且项目不与任何代理、VPN、ISP 合作。 参考:OpenWrt GitHubOpenWrt 下载目录ZeroOmega GitHubZeroOmega Chrome Web StoreZeroOmega Firefox Add-on

3.6 生成游戏、Fable 与 AI 视觉审美

群聊里聊到了什么:大家从 Fable 生成游戏、虚幻 5 demo、黑神话风格案例,聊到 AI 做网页、海报、信息图时常见的“能做但不好看”。这里最实用的结论是:生成工具擅长从 1 到 20,但方向、风格、约束和审美判断仍然要由人给清楚。

做网页、海报、信息图或游戏 demo 时,可以先写一份设计约束:

维度要写清楚什么
品牌logo、品牌色、字体、口号、禁用风格
布局首屏重点、模块数量、卡片比例、移动端尺寸
内容主标题、短文案、CTA、必须保留的信息
视觉参考图、留白、字号层级、图标风格
验收截图检查、手机可读性、文本不溢出、颜色准确
资料补充:AI 视觉生成的公开语境 OpenAI 图像生成文档把图像生成用于沟通、说服、分析等场景,并强调文字渲染、多轮编辑、指令遵循和参考图上下文;API 支持从文本生成、编辑现有图片、用参考图生成新图。Adobe Firefly 则把图像、视频、音频、设计、mood board、storyboard 等创意流程放进同一套生成式工具。公开发布时还可以关注 C2PA / Content Credentials,它们提供内容来源和编辑历史的开放标准。 参考:OpenAI Image Generation APIOpenAI 4o Image GenerationAdobe FireflyC2PAContent Credentials

4. 高质量内容与资源索引

类型资源用途
方法特殊 token / tokenizer 粗测判断模型是否是原版模型、辨别模型方
方法多 Agent milestone + reviewer + auditor让长任务更可控
方法小模型题面结构化 prompt把图片题转成可推理文本
方法AI 视觉产出检查表提高网页、海报、信息图质量
项目SEU-OpenWrt-Gateway东大校园网关方案
项目HR / 求职主理人中文校招/实习求职 AI 工具
项目搭子SEU东大校园伙伴匹配
项目技能五子棋经典游戏机制改造
工具ZeroOmega浏览器侧代理配置切换
官方资料A2A Protocolagent 间互操作
官方资料Claude Code Subagents专用子代理与上下文隔离
官方资料Qwen3.5 / Qwen3.6小模型识图与视觉 Agent
官方资料OpenWrt路由器系统与网络能力