过去 12 小时 AI 圈有两项值得关注的实用动态:一套 Codex 多智能体分工方法尝试用高能力模型负责规划与验收、把具体实现交给工作模型,以控制额度并提高产出;Grok 则新增对任意视频的分析能力,继续把多模态入口从图片和文本扩展到视频理解。

技巧与观点

Codex 用 Sol 指挥 Luna Max,尝试以分工提高额度效率

来源:X:阿易 AI Notes,18:47 | 原文链接

该方法让 Sol 负责拆解需求、制定计划和最终检查,再通过自定义代理配置把具体实现任务交给 Luna Max。分享者给出的核心配置思路,是在 ~/.codex/agents/ 中定义工作代理,并指定模型与推理强度;主代理保持全局判断,工作代理承担边界清楚的编码任务。

这类分工真正有价值的地方不只是“省额度”,而是把计划、实现和审查拆成不同阶段。适合独立并且可验证的任务,例如编写一个模块、补一组测试或调查某个错误;对于强耦合的小改动,代理间传递上下文的成本可能高于收益。使用时还应限制工作目录和权限,并由主代理复核测试结果与最终差异,不能把模型分工等同于质量保证。

AI 产品

Grok 支持分析任意视频

来源:X:Elon Musk(xAI),14:23 | 原文链接

xAI 宣布 Grok 可以分析任意视频。视频理解通常需要同时处理画面、语音、字幕和时间顺序,相比单张图片更适合用于内容摘要、关键片段定位、讲解提取和事件梳理。

目前公开消息只说明能力已经提供,尚不足以判断支持的视频长度、文件大小、语言范围、时间定位精度和使用额度。实际使用时应先用短视频验证:让模型列出带时间点的关键事件,再抽查原片;涉及人物身份、新闻事实或专业判断时,还需要人工核对。上传视频也可能包含人脸、声音、位置与商业资料,应先确认平台隐私条款和内容授权。


今日关键词:Codex 多智能体、模型分工、Grok、视频理解