这期 AIWatch 精选周刊围绕「product、discussion、tips」复盘过去一周的关键变化,先给出编辑导读,再把核心精选和延伸内容串成一条可阅读的脉络。聚焦 18 · 关注 0 · 跟进 10。
如果只想抓住本周主线,先读:Bento 发布了一款开源的 PowerPoint 替代品,以单一 HTML 文件实现自包含的演示文稿编辑与播放,并支持 AI 直接编辑文档 JSON → Latent Space 指出 AI 流水线中人类组件正被模型模拟取代,合成数据与模拟环境成为主流,使成本降低百倍、速度提升万倍 → Unsloth Studio 新增对 AMD 硬件的支持,两天内完成 30 次提交,加速推进兼容性。
本周最值得带走的观察,是「product、discussion、tips」已经从单点更新变成连续趋势。
正文内容概括Bento 发布了一款开源的 PowerPoint 替代品,以单一 HTML 文件实现自包含的演示文稿编辑与播放,并支持 AI 直接编辑文档 JSON。
核心观点提炼常规快讯,保留列表
正文内容概括Latent Space 指出 AI 流水线中人类组件正被模型模拟取代,合成数据与模拟环境成为主流,使成本降低百倍、速度提升万倍。
核心观点提炼常规快讯,保留列表
正文内容概括Unsloth Studio 新增对 AMD 硬件的支持,两天内完成 30 次提交,加速推进兼容性。
核心观点提炼常规快讯,保留列表
正文内容概括Anthropic 用 Claude Code 在两周内完成百万行代码迁移,成本仅 16.5 万美元,并提炼出可复制的六步流程和反常识原则。
核心观点提炼常规快讯,保留列表
正文内容概括Amp 发布了 Orbs 的多人协作功能,允许团队与 AI 代理在同一工作单元中协同工作。
核心观点提炼常规快讯,保留列表
正文内容概括Matt Pocock 发布了 /wayfinder 技能,通过“战争迷雾”概念帮助开发者在项目规划阶段管理不确定性,自动协调多个规划会话。
核心观点提炼常规快讯,保留列表
正文内容概括Codepilot 预告新版本将允许用户为每个 SubAgent 指定不同模型(如 Grok、DeepSeek、Kimi),以发挥各模型特长。
核心观点提炼常规快讯,保留列表
正文内容概括Jie Tang提出后训练缩放定律新观点,强调参数计数需结合数据、计算和运行条件,并介绍GLM 5.3通过合成RL环境取得重大进展。
核心观点提炼常规快讯,保留列表
正文内容概括腾讯混元发布了首个研究代理Hyra-1.0,可递归改进解决方案,用于性能驱动的研究和工程任务。
核心观点提炼常规快讯,保留列表
正文内容概括Sakana AI 发布了 Fugu-Cyber 模型,在真实世界安全基准上达到最先进性能,匹配 GPT-5.5-Cyber 等前沿模型。
核心观点提炼常规快讯,保留列表
正文内容概括AI周报播客第248期回顾了Claude Fable 5发布、苹果Siri AI、OpenAI与Anthropic IPO竞赛、Gemma 4开源模型及多项AI安全政策动态。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI 重申为符合条件的 API 客户提供零数据保留,并预览私有安全处理以在不牺牲数据隐私的前提下实现高级 AI 安全。
核心观点提炼常规快讯,保留列表
正文内容概括Replit 发布了由 GPT-5.6 Luna 驱动的 Free Mode,让用户无需担心 token 成本即可将想法转化为可运行的软件。
核心观点提炼常规快讯,保留列表
正文内容概括AINews 汇总:内存价格飙升 500%,OpenAI 暂停前沿 RL 训练,Qwen3.8-27B 等模型发布,Mojo 开源,TensorRT Connect 推出。
核心观点提炼常规快讯,保留列表
正文内容概括阿里Qwen团队发布了Qwen3.8预览版的最新更新,在web前端能力上有显著提升,并计划推出正式版和开源权重。
核心观点提炼常规快讯,保留列表
正文内容概括OpenAI 发布了 ChatGPT for Teens,这是专为青少年设计的 AI 助手,内置更强的安全保护措施、健康使用功能和家长控制选项,帮助青少年安全、自信地利用 AI 进行学习和批判性思考。
核心观点提炼常规快讯,保留列表
正文内容概括Stripe 以 70 亿美元收购 OpenRouter,获得高利润模型路由 API 层,加速 AI 基础设施垂直整合,影响开发者 API 使用成本。
核心观点提炼常规快讯,保留列表
正文内容概括Latent Space 发布 AI 新闻汇总,涵盖 GLM-5.3、Qwen3.8、DeepSeek V4-Pro 等模型发布及 agent 运行时讨论,带来行业动态更新。
核心观点提炼常规快讯,保留列表
本节暂无内容。
正文内容概括Google 在 Flash 系列基础上发布 Gemini 3.7 Flash,专为编码和智能体任务优化。相比 3.6 Flash,在代码生成、Web 开发、知识工作等基准测试上显著提升,如 FrontierCode 1.1 从 34.4% 升至 43.6%,WebDev Arena Elo 从 1538 升至 1588。同时推出半价优惠,输入 $0.75/1M tokens,输出 $3.75/1M tokens,使开发者能更经济地扩展生产级智能体。模型已集成到 Gemini Spark 等产品中。 核心观点: 1. Gemini 3.7 Flash 在 FrontierCode 1.1 Main 上达 43.6%,较 3.6 Flash 的 34.4% 提升 9.2 个百分点。 2. 在 WebDev Arena 中 Elo 得分从 1538 升至 1588,生成更功能完整的 Web 应用。 3. AutomationBench 得分从 17.0% 升至 30.4%,企业工作流自动化能力显著增强。
核心观点提炼高信息密度,值得细读
正文内容概括Meta发布了Muse Glimmer开放权重模型(30B参数,Apache 2.0),专为本地代理设计,支持复杂多步骤任务。
核心观点提炼常规快讯,保留列表
正文内容概括阿里Qwen实验室发布Qwen 3.8 27B开源模型,默认推理开销极高导致本地生成耗时数十分钟,但模型在视觉和代码生成上表现出色。
核心观点提炼常规快讯,保留列表
正文内容概括Martin Alderson 提出了降低 AI 推理成本的系统方法,包括成本审计、模型替换和 Agent 优化,可帮助团队显著减少开支。
核心观点提炼常规快讯,保留列表
正文内容概括Claude Code 的 /code-review 命令新增 effort 级别,低级别以更低 token 成本超越其他工具,高级别提供更高召回率。
核心观点提炼常规快讯,保留列表
正文内容概括Google对Gemma 4进行了重大改进,提升了工具调用和聊天准确性、可靠性和速度,并提供了更新后的量化版本。
核心观点提炼常规快讯,保留列表
正文内容概括狗哥笔记正式开源拼贴动画B-roll Skill,基于Codex和Gemini Omni Flash实现从口播文稿到竖版拼贴动画的自动化生成工作流。
核心观点提炼常规快讯,保留列表
正文内容概括AIE World's Fair 2026 指出 AI 工程进入新阶段,从用 agent 构建转向围绕 agent 构建系统。
核心观点提炼常规快讯,保留列表
正文内容概括Google DeepMind 发布文章探讨 AI 代理在科学发现中从提出假设到设计实验的潜力,指出验证瓶颈并提出四项政策优先事项。
核心观点提炼常规快讯,保留列表
正文内容概括NVIDIA 发布了 ARDY 实时 AI 动画工具,用户可通过文本描述生成角色动作序列,并在 Hugging Face Spaces 上试用。
核心观点提炼常规快讯,保留列表
摘要由 LLM 生成,请以原文为准。