Ben Davis 分享了 Codex 配置技巧,使其在计划模式外使用多项选择工具,显著改善使用体验
正文内容概括Ben Davis 分享了 Codex 配置技巧,使其在计划模式外使用多项选择工具,显著改善使用体验。
核心观点提炼常规快讯,保留列表
今天这期 AIWatch 早报围绕「product、tips、Agent」展开,先用一段导语把当天主线收束起来,再按今日头条、推荐精选和补充速览逐条介绍。聚焦 7 · 关注 0 · 跟进 10。
如果只有 20 分钟,先读:Ben Davis 分享了 Codex 配置技巧,使其在计划模式外使用多项选择工具,显著改善使用体验 → 开发者通过vibe coding使用GPT和Codex构建了3D人体解剖学应用,将模型大小从900MB优化至28.6MB,提升了交互性能 → 可能很多朋友不知道,Code Pilot 是全平台的一个软件。 而且支持 Cloud Code、AI SDK 和 CodeX 三种 Agent 框架的切换,以及市面上所有主流和常见 Token Plan 的...。
今天的主线不是孤立新闻,而是「product、tips、Agent」在不同层面的同步推进。
正文内容概括Ben Davis 分享了 Codex 配置技巧,使其在计划模式外使用多项选择工具,显著改善使用体验。
核心观点提炼常规快讯,保留列表
正文内容概括开发者通过vibe coding使用GPT和Codex构建了3D人体解剖学应用,将模型大小从900MB优化至28.6MB,提升了交互性能。
核心观点提炼常规快讯,保留列表
正文内容概括Code Pilot 发布 0.64.0 版本,重新加入 Linux 支持,并实现多种 Agent 框架与 Token Plan 切换。
核心观点提炼常规快讯,保留列表
正文内容概括Vaibhav Srivastav 提醒开发者评估工作流在所有模型上的表现,并分享将结构化输出任务从Sol迁移到Luna后成本降低96%的经验。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI Codex 为 ImageGen 新增 lightbox 和 canvas 功能,支持通过指向、擦除、评论等方式编辑图像,简化了视觉工作流。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI 将 ChatGPT 应用和 Codex CLI 的自动审查模型从 GPT-5.4 升级到 GPT-5.6 Luna,结合新定价使成本降低约 10 倍。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI 发布了 GPT-Live-Transcribe 和 GPT-Transcribe 两个新转录模型,分别用于低延迟实时转录和异步转录,提升了准确性和对多种口音、噪声的适应能力。
核心观点提炼常规快讯,保留列表
本节暂无内容。
正文内容概括山中大熊分享 LLM 流式输出下 UI 渲染性能优化原则:增量追加节点、节流刷新、使用轻量组件,避免每次 token 重绘。
核心观点提炼常规快讯,保留列表
正文内容概括dotey指出Codex上下文压缩已足够,无需频繁新开Session,并建议设置验收标准防止AI偷懒。
核心观点提炼常规快讯,保留列表
正文内容概括Y Combinator 开源了内部多智能体工具 QM,采用 MIT 许可证,支持云优先和 Slack/Web UI,便于公司各部门定制使用。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI 为 ChatGPT 应用和 Chrome 扩展增加了浏览器 URL 建议、引用标签页和高亮提问功能,提升了网页交互体验。
核心观点提炼常规快讯,保留列表
正文内容概括Mureka 发布 V9 音乐生成模型,在 Artificial Analysis 音乐排行榜上位列第二,支持多语言歌词和音轨分离,提供更自然的歌声和更强的提示控制。
核心观点提炼常规快讯,保留列表
正文内容概括DeepSeek V4 Flash 0731 在 GDPval-AA v2 评估中取得 1559 Elo 分,较前代 1189 分显著提升,展示了更强的智能体任务能力。
核心观点提炼常规快讯,保留列表
正文内容概括华为开源了首个完全在昇腾 NPU 上训练的 500B+ MoE 模型 openPangu-2.0-Pro,但 benchmark 表现处于第二梯队。
核心观点提炼常规快讯,保留列表
正文内容概括YC 开源了其内部用于会计、法务、活动运营等真实业务的多人 Agent 系统 QM。其核心抽象是 scope(作用域),为每个用户、频道、项目提供独立的记忆、文件、密钥和权限,实现个人隔离与协作共享。架构采用 Headless Core 设计,支持替换底层模型(如 Pi、OpenCode、Codex、Claude Code),持久层使用 Postgres 和隔离沙箱。安全提供 Strict、Auto、Dangerous 三种模式。该系统为 Agent 的权限与上下文边界设计提供了参考。 核心观点: 1. QM 通过 scope 作用域按人和空间划分权限与上下文边界,实现个人隔离与协作共享。 2. 架构采用 Headless Core,模型可替换,不绑定单一厂商,体现反锁定立场。 3. 安全模式提供 Strict、Auto、Dangerous 三种,Auto 模式使用分类器进行来源标注和筛查。
核心观点提炼高信息密度,值得细读
正文内容概括社区贡献者@realJerryzhou、@ispobaoke等实现了在紧凑平台上本地运行强智能体的支持,当前设置(并发1)推理速度24 tok/s(无MTP),并提供了cookbook快速上手指南。开发者可以基于此在本地部署强智能体,未来还将支持DSpark系统。 核心观点: 1. 当前推理速度24 tok/s(无MTP),在紧凑平台上本地运行强智能体。
核心观点提炼高信息密度,值得细读
正文内容概括datasette-agent 发布 0.4a0 版本,新增 browser_task 机制,使代理工具能在用户浏览器中直接执行 JavaScript 代码。
核心观点提炼常规快讯,保留列表
摘要由 LLM 生成,请以原文为准。