🔥 今日看点
- 腾讯发布并开源 Hy4 preview:770B 总参数 MoE、超 100 万 token 上下文,登顶 HN(164 分)
- vLLM v0.28.0 发布:Kimi-K3 与 DeepSeek V4 推理栈深度优化,584 个 commit
- GLM-5.3-Flash 被指可承接 45% 推理负载:中美推理成本战进入白热化
- GitHub Trending:科学 Agent 技能库单日 +1,587★,Agent 技能生态全面爆发
📰 模型与产品动态
1. 腾讯开源 Hy4 preview:770B 参数 MoE 大模型登顶 HN
腾讯发布并开源下一代大模型 Hy4 preview:770B 总参数、49B 激活参数的 MoE 架构,上下文窗口超过 100 万 token,以 164 分登顶 Hacker News。延续 DeepSeek、GLM 的路线,国产开源大模型在参数规模与长上下文上继续冲顶;配合开源权重,开发者可本地部署、微调或接入云服务,进一步挤压闭源模型的定价空间。
官方公告 · HN 讨论
2. vLLM v0.28.0 发布:Kimi-K3 与 DeepSeek V4 推理性能大跃进
vLLM v0.28.0 正式发布,含 584 个 commit、来自 270 位贡献者(76 位新人)。重点优化:Kimi-K3 全栈性能提升(Decode Context Parallel、融合 FlashKDA decode/prefill kernel、SiTU 激活、GEMM-RS 序列并行,combined all-gathers 带来 1.5~3 倍 kernel 级加速,共享专家分片单卡省约 17GiB 显存);DeepSeek V4 稀疏 MLA 端到端可用(覆盖 MTP 与 DSpark 投机解码);新增 DFlash2 投机解码、分层 KV Cache 磁盘卸载、Model Runner V2 成熟化,以及 Rust 前端与 gRPC 多模态推理。开源推理栈的"卷"正在直接转化为下游模型服务成本下降。
发布说明 · HN 讨论
3. GLM-5.3-Flash 或承接 45% 推理负载:成本战改写模型选型
VentureBeat 分析:神秘模型 Ox Alpha 在 OpenRouter 免费跑出数万亿 token 后揭晓身份——即 Z.ai 的 GLM-5.3-Flash,全程跑在中国芯片与基础设施上,定价仅 $0.15/$0.50 每百万 token(OpenRouter 促销再打五折)。按智能-成本曲线,该模型以约 9 美分/任务的成本达到 57 分智能,而同等智能的美国中端模型贵 7 倍以上。作者建议将任务分三层:5% 用顶级模型、50% 用中端、45% 用 Flash 类高性价比模型;并预告 9 月 Google、xAI、Anthropic、OpenAI、DeepSeek 将集中发布新模型,价格战还将继续。
阅读全文
4. StemDeck:开源本地 AI 音频分轨工具登 HN
免费、开源、完全本地运行的 AI 音频分轨工具 StemDeck 以 199 分登上 HN:可将音乐分离为人声、鼓、贝斯等独立音轨,全程在本地设备完成、无需上传云端。在音乐制作、播客后期等隐私敏感场景中,"本地优先"的 AI 创作工具正从小众走向主流,与 Perplexity Portable Computer 的本地化思路形成呼应。
仓库 · HN 讨论
🌐 Hacker News 热门讨论
5. Domain-Driven Agents:用领域驱动设计构建 Agent(37 分)
HN 热文提出以领域驱动设计(DDD)方法论构建 Agent:先用领域模型界定 Agent 的边界、语言与职责,再动手写实现。作者认为多数 Agent 项目失败源于领域边界模糊而非模型能力不足——当 Agent 不知道该管什么、不该管什么时,再强的模型也会跑偏。为 Agent 架构师提供了一套可落地的设计流程,社区讨论聚焦"Agent 也需要软件工程纪律"。
文章 · HN 讨论
⭐ GitHub Trending 热门项目
6. K-Dense-AI/scientific-agent-skills:科学 Agent 技能库(+1,587★,总 37.9k)
号称"把任意 AI Agent 变成 AI 科学家":165 个开箱即用、经过验证的科学技能,覆盖实验设计、数据分析、文献工作流等,宣称已被全球 19 万+ 科研人员使用。Agent 技能库正从编程领域向科学计算等垂直场景渗透,今日新增星数高居 Trending 前列。
仓库
7. THU-MAIC/OpenMAIC:清华多智能体交互课堂(+907★,总 22.2k)
清华开源的"多智能体交互课堂":一键搭建沉浸式多 Agent 学习环境,多个 AI 角色协作授课、答疑与讨论。教育场景的多 Agent 编排成为新的开源热点——从单聊机器人到"一群 AI 老师",Agent 协作的产品形态正在教育领域落地。
仓库
8. JetBrains/go-modern-guidelines:给 AI 编码 Agent 看的现代 Go 规范(+303★)
JetBrains 出品的指南仓库,教 AI 编码 Agent 写出符合现代实践的 Go 代码。随着 AI 生成代码占比快速上升,"面向 Agent 的编码规范"正成为 IDE 厂商与团队的新基建——从给人写文档,转向给 Agent 写约束与最佳实践。
仓库
9. addyosmani/agent-skills:个人维护的 9 万星技能库(+196★,总 90.7k)
Google Chrome 团队 Addy Osmani 维护的 Agent 技能合集,涵盖前端开发、性能优化等实用技能包,总星数已达 9 万+。个人开发者维护的 Agent 技能库能做到这个量级,说明"技能即代码"的生态正在成型,可复用的 Agent 能力正在资产化。
仓库
10. abi/screenshot-to-code:截图转代码经典项目再登榜(+550★,总 76k)
经典项目 screenshot-to-code 今日新增 550 星:拖入截图即可生成干净的 HTML/Tailwind/React/Vue 代码。设计稿到前端的自动化链路持续迭代,仍是 AI 编程工具中最直观的"所见即所得"用例,也是评估多模态代码生成能力的最佳基准之一。
仓库
11. p-e-w/heretic:自动去除 LLM 审查的工具(+150★,总 28.7k)
完全自动化的"模型去审查"工具:自动移除大语言模型内置的审查与对齐限制。开源社区对模型对齐边界的持续对抗,反映出自部署场景下"模型可控性"仍是开发者关注的核心议题——开源权重给了用户选择权,也带来治理挑战。
仓库
12. Osmantic/ODS:把电脑变成 AI 服务器(+35★,总 4.9k)
开源项目 ODS 可把 PC/Mac/Linux 一键变成 AI 服务器:集成 LLM 推理、聊天 UI、语音、Agent、工作流、RAG 与图像生成。与 Perplexity Portable Computer 的本地化思路同频,"本地 AI 一体机"的开源方案正在升温。
仓库
13. ComposioHQ/awesome-claude-skills:Claude Skills 精选清单(+73★,总 73.9k)
Composio 维护的 Claude Skills 精选资源清单,覆盖自定义 Claude 工作流的技能、工具与教程,总星数近 7.4 万。在 Anthropic 官方插件目录(昨日报道)之外,第三方技能生态同步壮大,Agent 插件化正成为平台标配扩展模式。
仓库
本日报由 TimLake AI 编辑自动采集整理,数据来自 VentureBeat、Hacker News、GitHub Trending、Tencent 等公开来源。