🔥 今日看点

  • OpenAI 大幅降价:GPT-5.6 Luna 降价80%,Terra 降价20%,AI模型价格战全面升级
  • Thinking Machines 发布 Inkling Small:276B参数MoE模型,性能接近旗舰版但体积仅1/4
  • Google DeepMind 发布 Gemini Robotics 2,实现机器人全身体智能控制
  • 企业AI Agent安全治理成为焦点,5家初创公司获 VentureBeat 专题报道
  • HuggingFace speech-to-speech 开源框架登顶 GitHub Trending(8.7k★)
  • Anthropic 公开网络安全评估中三起真实事件调查结果

📰 VentureBeat 精选

1. Thinking Machines 发布 Inkling Small:1/4体积、近乎旗舰性能的开源MoE模型

由前OpenAI CTO Mira Murati 领导的 Thinking Machines 推出 Inkling-Small(276B参数,12B活跃参数),采用稀疏MoE架构(42层解码器、256专家),在 Artificial Analysis Intelligence Index 上得分40(旗舰版41)。在 SWE-bench Verified 上达80.2%(超旗舰版77.6%),Terminal Bench 2.1 达64.7%。Apache 2.0许可,完整权重已上传 Hugging Face,支持通过 Tinker API 微调。首发限时50%折扣,64K上下文版定价 $0.58/百万输入Token。
阅读全文

2. AI价格战升级:OpenAI 将 GPT-5.6 Luna 价格下调80%

OpenAI 大幅削减 GPT-5.6 系列定价:Luna 降至 $0.20/$1.20(输入/输出百万Token),Terra 降至 $2/$12,旗舰 Sol 新增 Fast 模式(2倍吞吐,$10/$60)。此举紧随 Anthropic Claude Opus 5 以 Opus 4.8 同价发布、以及 Google Gemini 3.6 Flash/3.5 Flash-Lite 的低推理成本策略。OpenAI 正通过直接降价争夺开发者市场,尤其在高频调用和Agent工作负载场景中竞争激烈。
阅读全文

3. 企业AI Agent安全:5家初创公司解决互操作性、权限与审计难题

VentureBeat专题报道了 Arcade.dev 等五家初创企业如何应对企业AI Agent在互操作性、权限管理和审计追踪方面的核心痛点。其中一家公司将网络攻击遏制时间从7小时缩短至12分钟。报道指出,当前AI Agent之间无法互相通信、无法可信授权、也无法被审计,这已成为企业规模化部署的最大障碍。
阅读全文

4. Nimble 发布领域专用Web搜索Agent,Token成本减半

Nimble 推出领域专用 Web Search Agent,通过结合专有索引与实时网页检索以及任务级搜索策略,将 Token 消耗降低一半,同时提升检索准确率。不再采用一刀切的搜索算法,而是为每个领域定制搜索策略——这对 RAG 应用和 Agent 工具调用场景尤为有意义。
阅读全文

5. Bright Machines 发布混合机器人单元解决AI基础设施瓶颈

Bright Machines 宣布推出 Hybrid BRC(混合机器人单元),旨在解决AI基础设施部署中的硬件瓶颈。该方案结合传统工业机器人与AI驱动的柔性制造,可用于数据中心 GPU 集群的自动化运维,降低大规模AI部署的物理基础设施门槛。
阅读全文


🌐 Hacker News 热门讨论

6. Google DeepMind Gemini Robotics 2:机器人的全身体智能

以457票、386条评论登顶HN。Gemini Robotics 2 赋予机器人全身协同控制能力,从单一肢体动作升级为多关节、多模态的全身协调。结合视频理解与多机器人协作,使机器人能完成更复杂的物理任务,如抓取、移动和组装。同时发布的 Gemini Robotics ER 2 进一步支持视频理解、任务编排和多机器人协作。
讨论 | DeepMind Blog

7. Anthropic 公开网络安全评估中的三起真实事件调查

Anthropic Frontier Red Team 发布报告,详细披露了在网络安全评估中遇到的三起真实世界安全事件,包括AI系统被试探性攻击的模式、红队测试方法论以及防御策略。66分讨论热度,反映出业界对AI Agent安全性的高度关注。
讨论 | Anthropic News

8. GitHub Stacked PRs 正式上线

GitHub 宣布 Stacked PRs 功能正式上线,获得434票。该功能允许开发者将一个大型变更拆分为多个相互依赖的小型PR,按顺序审查和合并。对于使用AI辅助编程工具(如 Claude Code、Cursor)的开发团队而言,这一功能极大提升了代码审查效率和大规模重构的可管理性。
讨论


9. huggingface/speech-to-speech — 用开源模型构建本地语音Agent

当日新增628星,总星8,789。该项目提供一套完整的端到端语音交互框架,支持在本地部署语音Agent,涵盖语音识别、自然语言理解和语音合成全链路。对于希望构建语音助手但又不想依赖云端API的开发者是非常实用的工具。
仓库

10. different-ai/openwork — Claude Cowork 的开源替代方案

当日暴增915星,总星18,721。基于 opencode 构建的开源工作助手,功能对标 Anthropic 的 Claude Cowork。支持代码生成、文件操作和终端命令执行,是开发者在本地搭建 AI 编码助手的热门选择。
仓库

11. mvanhorn/last30days-skill — AI Agent 全网研究技能

总星55,545,当日新增378星。这是一个 AI Agent 技能(skill),可跨 Reddit、X(Twitter)、YouTube、Hacker News、Polymarket 和全网搜索任意主题,综合生成有据可查的摘要报告。对于需要快速掌握某个领域近况的研发人员非常实用。
仓库


🤖 DeepMind & Google AI 动态

12. Gemini 3.6 Flash / 3.5 Flash-Lite 发布,Google 推进低成本推理

Google DeepMind 发布 Gemini 3.6 Flash 和 3.5 Flash-Lite 模型,主打低推理成本和高效Agent工作负载。同时推出的 Gemini 3.5 Flash Cyber 聚焦网络安全场景,支持代码安全分析和威胁检测。此外,DiffusionGemma 实现4倍文本生成加速,Computer Use 功能正式进入 Gemini 3.5 Flash。
DeepMind Blog

13. Google Gemini Spark 个人AI Agent 集成 Chrome 浏览器

据 The Verge 报道,Google 的 Gemini Spark 个人AI Agent 现已集成 Chrome 浏览器,可帮助用户完成公寓看房信息整理、航班比价和预订流程启动等任务。但支付等敏感操作仍需人工确认。Spark 同时扩展到 AI Pro 订阅层的160个更多国家。
The Verge


📝 编辑点评

今日最显著的趋势是 AI模型价格战全面爆发:OpenAI 80%降价、Google 推低成本推理模型、Anthropic 强调同价更强性能——三家巨头在成本效率上的竞争已白热化。对于产品研发团队而言,这是一个窗口期:更低的API成本意味着Agent和AI功能的实验门槛大幅降低。

另一个重要信号是 Agent安全治理从幕后走向台前:VentureBeat的专题报道和Anthropic的安全事件公开,都表明行业正在从「能不能做Agent」转向「如何安全地运营Agent」。权限管理、审计和互操作性将成为下一阶段Agent平台的核心竞争力。

在开源社区,语音Agent框架(HuggingFace speech-to-speech)和Agent研究技能(last30days-skill)的爆火,反映出开发者正在从Chat对话转向构建自主运行的Agent系统。