今天这期 AIWatch 早报围绕「product、technology、NVIDIA」展开,先用一段导语把当天主线收束起来,再按今日头条、推荐精选和补充速览逐条介绍。聚焦 17 · 关注 0 · 跟进 10。
如果只有 20 分钟,先读:基于 bento PPT 改造了一个 Skill。 输入内容或主题,自动生成可编辑修改、在线演示,甚至可以发给别人协作的HTML PPT。 安装指令:npx skills add joeseesun/qi... → Replicate 发布了本地工作流 Agent Skill,支持在本地运行模型、并行预测、自动下载文件并嵌入元数据,方便开发者管理输出 → Google 扩展了 Gemini API 的 managed agents 功能,推出 3.6 Flash 和 hooks,为开发者提供更灵活的 AI 代理构建能力。
今天的主线不是孤立新闻,而是「product、technology、NVIDIA」在不同层面的同步推进。
正文内容概括vista8 发布了基于 bento PPT 改造的 Skill,可输入主题自动生成可编辑协作的 HTML PPT。
核心观点提炼常规快讯,保留列表
正文内容概括Replicate 发布了本地工作流 Agent Skill,支持在本地运行模型、并行预测、自动下载文件并嵌入元数据,方便开发者管理输出。
核心观点提炼常规快讯,保留列表
正文内容概括Google 扩展了 Gemini API 的 managed agents 功能,推出 3.6 Flash 和 hooks,为开发者提供更灵活的 AI 代理构建能力。
核心观点提炼常规快讯,保留列表
正文内容概括Google AI 在 Google Earth 上推出由 Nano Banana 2 驱动的图像生成功能,用户通过文本提示即可将卫星影像转化为想象中的场景,带来全新的地图交互体验。
核心观点提炼常规快讯,保留列表
正文内容概括Tinker团队发布了Inkling-Small开源模型,性能接近Inkling但体积缩小4倍,支持多模态和长上下文,为开发者提供高效选择。
核心观点提炼常规快讯,保留列表
正文内容概括NVIDIA 联合行业领导者推出 Open Secure AI Alliance,旨在通过开放模型和工具共享来提升 AI 安全防御能力。
核心观点提炼常规快讯,保留列表
正文内容概括Cursor 发布了 iPad 版本并新增 PR 收件箱功能,支持在移动设备上审查、评论和批准合并请求。
核心观点提炼常规快讯,保留列表
正文内容概括1969年定理给出整数集合和差集增长指数上界为2,但50多年来最佳构造仅略超1.1。借助研究代理Hyra和Hy3模型,研究人员找到了显式构造,证明最优指数恰好为2,解决了这一长期问题。这展示了AI在数学研究中的辅助作用。 核心观点: 1. 借助Hyra和Hy3,构造出整数集合和差集增长指数为2的显式例子,证明最优指数为2。 2. 1969年定理给出上界2,但50多年来最佳构造仅略超1.1。
核心观点提炼高信息密度,值得细读
正文内容概括Ant Ling 在 Dify 市场上线了模型提供商插件,用户可在 Dify 应用、代理和工作流中使用 Ant Ling 模型。
核心观点提炼常规快讯,保留列表
正文内容概括GitHub Copilot高效使用指南提出八步工作流,强调学透工具、开启自主模式、原型先行、跨模型评审等务实方法。
核心观点提炼常规快讯,保留列表
正文内容概括Runware 发布了 Ideogram Object Remover 功能,该功能在 OmniEraser 基准测试中取得第一,支持图像加遮罩一键移除物体、阴影和反射。
核心观点提炼常规快讯,保留列表
正文内容概括Cline 发布 CLI 更新,集成 Kimi K3 模型,通过递归自我改进将 Terminal Bench 性能从 77.5% 提升至 88.8%,运行成本降低。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI 指出两个 API 设置可提升 GPT-5.6 在 ARC-AGI-3 上的性能,通过保留推理和启用压缩使分数提高三倍并提升效率。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI宣布为科研人员免费提供前沿模型访问,计划从1万扩展到10万,旨在加速科学发现。
核心观点提炼常规快讯,保留列表
正文内容概括dotey 分享 AI 生成 PPT 经验,指出 HTML+CSS 是最佳中间格式,并推荐其 baoyu-design 项目实现美观与可编辑兼顾。
核心观点提炼常规快讯,保留列表
正文内容概括Cursor 发布了 iOS 和 iPadOS 版本,将 AI 编程 agent 能力带到移动设备,方便随时随地编码。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI 部署 GPT-5.6 Sol 后通过 GPU 内核改进和推测解码优化,使服务成本降低 20%、token 生成效率提升 15% 以上。
核心观点提炼常规快讯,保留列表
本节暂无内容。
正文内容概括Vercel Labs 开源 Native SDK,保留 Web 声明式 UI 体验,用自研引擎替代浏览器/WebView 直接绘制到 OS 窗口。基于 Zig 实现 Elm 架构,dev 模式热重载约2秒,release 模式编译时解析,二进制仅几 MB。内置 automation server 和 CLI agent skills,支持 AI 智能体读取 accessibility 快照、驱动 widget。开发者可用声明式范式构建高性能原生桌面应用,并集成 AI 自动化。 核心观点: 1. Native SDK 采用 Zig 实现 Elm 架构(Model/Msg/update/View),dev 模式热重载约2秒,release 模式 markup 编译进二进制,体积仅几 MB。 2. 自研引擎直接绘制到 OS 窗口,无浏览器/WebView,通过结构性 identity 和 keyed 列表确保跨重建状态稳定。 3. 内置 automation server,任何 agent 可读取 accessibility 快照、驱动 widget、断言状态,CLI 自带 agent skills。
核心观点提炼高信息密度,值得细读
正文内容概括OpenAI 发布了 GPT-5.6 模型,在 Terminal-Bench 基准测试上达到 91.9% 的新纪录。该模型定价与 GPT-5.5 相同,为每百万 tokens 输入 5 美元、输出 30 美元。相比之下,Claude 的 Fable 模型被从订阅中移除并转向 API,成本更高(每百万 tokens 输入 10 美元、输出 50 美元)。这一发布对开发者意味着在保持成本不变的情况下获得了更强的终端任务性能。 核心观点: 1. GPT-5.6 在 Terminal-Bench 上达到 91.9%,创下新纪录。 2. GPT-5.6 定价与 GPT-5.5 相同,每百万 tokens 输入 5 美元、输出 30 美元。 3. Claude 的 Fable 模型 API 定价为每百万 tokens 输入 10 美元、输出 50 美元,是 GPT-5.6 的两倍。
核心观点提炼高信息密度,值得细读
正文内容概括Moonshot AI 开源了基于 CUTLASS 的高性能 Kimi Delta Attention 内核 FlashKDA,在 SM90+ GPU 上实现 1.72–2.22 倍 prefill 加速。该内核支持 bf16 输入、可变长度批处理,可无缝集成到 flash-linear-attention 库中,为开发者提供高效的注意力计算方案。 核心观点: 1. FlashKDA 在 prefill 阶段实现 1.72–2.22 倍加速(基于 H20 基准测试)。 2. 要求 SM90+ 架构、CUDA 12.9+ 和 PyTorch 2.4+。 3. 内核 API 要求 K=V=128,支持 bf16 输入和可变长度批处理。
核心观点提炼高信息密度,值得细读
正文内容概括OpenAI 宣布向10万名学术研究人员免费提供ChatGPT高级模型访问,以加速科学发现。
核心观点提炼常规快讯,保留列表
正文内容概括MCP协议发布重大版本,核心从有状态双向改为无状态请求/响应,每个请求独立携带版本和客户端信息,可负载到任意实例,使服务器能像HTTP服务部署,便于负载均衡和serverless。同时引入MRTR处理用户输入确认,请求头新增字段便于路由鉴权,授权加固。废弃部分功能但提供12个月过渡期。四个一级SDK同步更新,AWS、Microsoft、Cloudflare、Google Cloud等支持。开发者需评估迁移成本,但SDK团队已简化流程。 核心观点: 1. 协议改为无状态请求/响应,每个请求独立携带版本和客户端信息,可负载均衡,支持serverless部署。 2. MRTR允许服务端返回“需要输入”状态,客户端带用户回答重新请求,解决中途确认问题。 3. 请求头新增Mcp-Method和Mcp-Name,网关可直接根据请求头路由鉴权,无需解析JSON体。
核心观点提炼高信息密度,值得细读
正文内容概括OpenAI 宣布使用 GPT-5.6 Sol 在 Codex 中优化自身基础设施,实现推理成本降低 20%、token 生成效率提升 15% 以上。
核心观点提炼常规快讯,保留列表
正文内容概括视频扩散模型生成速度慢,限制了实际应用。NVIDIA研究团队提出并行解码蒸馏(PDD)技术,通过并行解码和蒸馏方法加速视频扩散模型,并在LTX-2.3模型上展示效果。该技术有望大幅提升视频生成速度,为开发者提供更高效的视频生成方案,推动视频扩散模型在实时应用中的部署。
核心观点提炼高信息密度,值得细读
正文内容概括作者从技术主管(TL)转变为工程经理(EM)后,改变了对Coding Agent的使用方式。以前事必躬亲,现在放权给Agent,只负责决策和验收。通过使用/goal命令让Agent自主执行编码和测试,极大释放了生产力。技术选型不再受限于个人熟悉度,从Electron转向Swift+AppKit再到Rust,开发效率提升,每天可迭代一个小版本。 核心观点: 1. 使用 /goal 命令让 Agent 根据技术方案自动执行编码和自动化测试。 2. 技术选型从 Electron 转向 Swift+AppKit 再转向 Rust,不再受限于个人技术栈。 3. 通过放权给 Agent,实现每天一个小版本迭代的开发节奏。
核心观点提炼高信息密度,值得细读
正文内容概括Perplexity 向 Open Secure AI Alliance 贡献了开源代理安全套件 Numbat,为安全团队提供系统级代理安全防护。
核心观点提炼常规快讯,保留列表
正文内容概括Codex 团队修复了使用量消耗过快的问题,重置了使用限制并增加了监控,以改善用户体验。
核心观点提炼常规快讯,保留列表
摘要由 LLM 生成,请以原文为准。