精讲 1
产品歸藏 @op7418本周精选66/100
正文内容概括DeepSeek 发布了 V4 Flash 正式版(DeepSeek-V4-Flash-0731),Agent 能力大幅提升,在 Terminal Bench 2.1 等多项基准测试中取得优异成绩(如 82.7)。该模型已在官方 API 上线,并支持 Codex API 格式,提供一键配置脚本,方便开发者快速集成。模型结构与预览版一致,仅重新进行了后训练,性能提升源于后训练优化。开发者可借此增强自动化任务能力。
核心观点:
1. 在 Terminal Bench 2.1 上得分 82.7,体现 Agent 能力显著提升。
2. 支持 Codex API 格式并提供一键配置脚本,简化集成流程。
3. 模型结构同预览版,仅后训练变化,性能提升来自后训练优化。
核心观点提炼高信息密度,值得细读
产品AgentAPICodex后训练基准测试
精讲 2
产品Meng Shao @shao__meng当日精选61/100
正文内容概括华为开源了首个完全在昇腾 NPU 上训练的 500B+ MoE 模型 openPangu-2.0-Pro,但 benchmark 表现处于第二梯队。
核心观点提炼常规快讯,保留列表
产品
精讲 3
产品Meng Shao @shao__meng当日精选64/100
正文内容概括YC 开源了内部使用的多人 Agent 系统 QM,采用作用域隔离和四层架构,为多智能体协作提供可参考的实现。
核心观点提炼常规快讯,保留列表
产品
精讲 4
产品NVIDIA AI @NVIDIAAI当日精选70/100
正文内容概括社区贡献者@realJerryzhou、@ispobaoke等实现了在紧凑平台上本地运行强智能体的支持,当前设置(并发1)推理速度24 tok/s(无MTP),并提供了cookbook快速上手指南。开发者可以基于此在本地部署强智能体,未来还将支持DSpark系统。
核心观点:
1. 当前推理速度24 tok/s(无MTP),在紧凑平台上本地运行强智能体。
核心观点提炼高信息密度,值得细读
产品Agent本地推理紧凑平台推理速度社区贡献
精讲 5
产品Simon Willison当日精选64/100
正文内容概括datasette-agent 发布 0.4a0 版本,新增 browser_task 机制,使代理工具能在用户浏览器中直接执行 JavaScript 代码。
核心观点提炼常规快讯,保留列表
产品
精讲 6
产品Simon Willison当日精选64/100
正文内容概括Simon Willison 发布了 llm-chat-completions-server 0.1a0,一个将 LLM 模型暴露为 OpenAI Chat Completions 兼容 API 的插件,利用内容可寻址日志优化对话状态管理。
核心观点提炼常规快讯,保留列表
产品
精讲 7
技巧宝玉 @dotey当日精选64/100
正文内容概括山中大熊指出Agent流式输出中断恢复的关键:一个Task一个Session保存上下文,并处理tool call截断,使恢复合法。
核心观点提炼常规快讯,保留列表
技巧
精讲 8
技术Simon Willison当日精选67/100
正文内容概括Simon Willison 介绍了无状态 MCP 规范并构建了 mcp-explorer 和 datasette-mcp 工具,简化了 MCP 协议的实现和使用。
核心观点提炼常规快讯,保留列表
技术
精讲 9
技术Simon Willison当日精选63/100
正文内容概括Simon Willison 发布了 smevals 评估套件,使开发者能快速创建和运行模型评估并生成报告。
核心观点提炼常规快讯,保留列表
技术
精讲 10
产品OpenAI Developers @OpenAIDevs当日精选59/100
正文内容概括OpenAI 发布了 ChatGPT 桌面应用的新 Activity 视图,将需要关注的对话和项目更新整合在一起,方便用户管理。
核心观点提炼常规快讯,保留列表
产品
精讲 11
产品OpenAI Developers @OpenAIDevs当日精选58/100
正文内容概括ChatGPT桌面应用新增点击宠物图标打开语音模式的功能,方便用户快速检查工作、批准或停止任务。
核心观点提炼常规快讯,保留列表
产品
精讲 12
技巧jason@jxnlco @jxnlco当日精选62/100
正文内容概括Forward Future Brian 指出 Luna 模型有隐藏的最佳模式,用户通过设置开启 Max 即可解锁最强性能。
核心观点提炼常规快讯,保留列表
技巧
精讲 13
技巧Fireworks AI @FireworksAI_HQ当日精选66/100
正文内容概括FireworksAI 发布教程,展示如何用不到10美元微调嵌入模型 Qwen3-Embedding-8B,在合法引用检索等任务上提升检索质量(+36% nDCG@10)。
核心观点提炼常规快讯,保留列表
技巧