在 Amazon Bedrock AgentCore 与 OpenClaw 上构建有记忆的上下文感知 AI 助手
:
推荐理由:文章给出了一套可复用的有状态 Agent 设计方法,包括记忆命名空间隔离、按任务路由模型和 prompt 缓存排序,可直接迁移到自己的助手项目。
:
推荐理由:文章给出了一套可复用的有状态 Agent 设计方法,包括记忆命名空间隔离、按任务路由模型和 prompt 缓存排序,可直接迁移到自己的助手项目。
Simon Willison 分享了如何让 Parseable 接收来自 Datasette 的 OpenTelemetry 追踪数据。Parseable 是兼容 OpenTelemetry 的新观测平台,开源版为 AGPL 协议的 Rust 实现(单个约 180MB 二进制文件),另有企业版与云端托管选项。
通过 Amazon SageMaker Unified Studio 管理 SageMaker HyperPod 时,可在组织、项目、集群、工作负载四个层级保留治理控制。
开发者 Niko1221 开源 Strata 引擎,可在 12GB 显存以上的消费级显卡上运行量化版 Qwen3.8-Flash-Next(1250 亿参数)模型。
推荐理由:原文给出把 MoE 专家分级载入 RAM 加投机解码的显存优化思路,可迁移到其他大模型本地部署场景。
Cohere 发布 North 2,将其企业平台升级为可跨会话保持上下文、自主执行多步工作流的 AI 智能体控制中心。平台模型无关,既支持 Command A+ 也可接入企业自有模型,并支持本地、云端及完全物理隔离部署,管理员可通过 North Admin 管理 token 用量、用户配额与访问权限,智能体执行关键操作前需请求人工批准。
智谱 GLM-5.3 接入亚马逊云科技旗下 Amazon Bedrock,AWS 基于模型调用量与智谱进行收入分成,公司近期已与多家海外云厂商落地该模式。国内方面,阿里云百炼平台等已签署类似分成协议,华为云上架 GLM-5.3 并达成合作意向。
Felix Rieseberg 说明 Cowork 新版本把模型推理和 VM 都放在云端运行,每个会话获得独立沙箱、不与其他会话共享状态。旧版本在用户电脑上运行 Anthropic 提供的 VM,带来磁盘、电量与性能代价,且合上笔记本工作就会停止;新版本中,桌面应用负责 VM 需要的本地文件访问工具调用。
一款命令行工具可快速移除 macOS 27 中的 Apple Intelligence。该工具可释放超过 12GB 的存储空间。
AWS 官方博客介绍如何在 AWS GovCloud (US) 中通过 Amazon Bedrock 运行 Claude Code,让受 ITAR 等合规要求约束的工作负载也能进行 AI 辅助开发。
Amazon SageMaker AI 通过 Agent Toolkit for AWS 推出 aws-ai-ml 智能体技能,让 Kiro、Claude Code、Codex 等支持 MCP 的编码智能体获得推理优化与基准测试能力。
AWS 官方博客演示如何用 Amazon Bedrock AgentCore Evaluations 构建并评估一个多智能体供应链决策系统,示例企业 AnyCompany Retail 采用一个编排智能体加优化、配送、路由、分析四个子智能体。
Simon Willison 认为按量付费服务和 API 应将硬性预算上限作为默认选项,即达到每月 $X 后直接断开服务并返回错误,因为编程智能体大幅降低了创建可消费代码的摩擦,软上限的警告邮件不足以防止一觉醒来收到巨额账单。
OpenAI 发布 GPT-6 系列模型实践指南,说明创业公司如何选择 GPT-6 模型、调节推理强度、优化提示词与技能、协调工具,并为生产环境准备工作流。
推荐理由:指南覆盖模型选型、推理强度调节与生产工作流准备,可直接用于 GPT-6 多版本之间的选型与调参决策。
Google Research 宣布新一代联邦学习系统,利用可信执行环境(TEE)提供完全可验证、可审计的数据匿名化保证,Gboard 已率先采用。新系统由客户端加密上传与访问策略、基于 RAFT 共识的 KMS 密钥管理、用 Federated Language 编排的 TEE 训练循环以及加密恢复状态协同工作,训练时间从此前的 1-2 个月大幅缩短,同时模型准确率提升。
推荐理由:原文对比了新旧联邦学习系统在隐私可验证性与训练效率上的差异,读者可了解 TEE 如何移除对服务器运营方的信任依赖。
Airbnb CTO Ahmad Al-Dahle 接受 Latent Space 采访,介绍公司向 AI-native 转型的由内而外策略:先用 AI 提速内部产品开发,再把同样能力用于客户体验。
NVIDIA 推出 DGX Spark 64GB 统一内存配置,本月由 Acer、ASUS、Dell、Gigabyte、HP、MSI 销售,10 月 23 日起售价 $4,999。
推荐理由:新配置把本地智能体开发门槛降到 $4,999,两台组网即可扩展至 128GB 内存,读者可据此评估本地部署的扩展路径。
NVIDIA AI 工厂通过高产能、耐用性与通用性三大特性最大化投资回报率。SemiAnalysis AgentX 数据显示,NVIDIA Vera Rubin NVL72 系统每兆瓦吞吐量比 GB300 NVL72 高 30 倍以上,在 DeepSeek V4 Pro 模型上每百万 token 成本最多低 45 倍。
Latent Space 在 OpenAI DevDay 后专访 Computer Use 负责人 Ari Weinstein 与 API 负责人 Nikunj Handa,逐项拆解当天发布的新 Agent 栈。
CoreWeave 在旧金山举行的 CoreWeave Fully Connected 大会上宣布 NVIDIA Vera Rubin NVL72 系统在 CoreWeave Cloud 上可用,并推出统一的训练与评估环境 CoreWeave Forge。
Google DeepMind 宣布为 Private AI Compute 平台引入私密的服务端记忆层,让 AI 在跨设备间保持长期连续性的同时维持与端侧处理同级的隐私标准。
推荐理由:原文给出安全飞地、加密通道与设备端密钥相结合的架构细节,可迁移到其他需要云上持久记忆的隐私保护设计中。
Mistral 与 Cloudera 宣布建立合作伙伴关系,将 Mistral 的模型集成到 Cloudera 混合数据平台,使企业能在私有云、公有云、本地及完全隔离环境中部署 AI 模型并保持完全控制。企业还可在受控环境中基于大量专有数据训练定制模型,同时保留数据与生成智能的所有权。该合作面向 Cloudera 平台上 30 exabytes 的客户管理数据,旨在满足不断增长的主权 AI 需求。
Mistral 帮助一家欧洲能源运营商将 4 万行 Fortran 77 油藏模拟器代码迁移到 C++,该代码库没有测试套件和集中文档。团队先给 Fortran 代码加状态导出并用 C++ 测试框架做数值一致性验证,再用 Vibe CLI 生成上百个智能体沿调用树整理散落在 PDF 和注释中的文档。
Mistral 与 HUMAIN 宣布战略合作,将在沙特及中东地区推进主权 AI,合作规模达数亿欧元。双方初期聚焦网络安全与语音,计划开发阿拉伯语表现强劲的前沿模型,Mistral 还将探索使用 HUMAIN 的数据中心基础设施支持本地算力需求。两家公司同时计划在沙特推出面向受监管行业的联合市场策略。
Mistral AI 发布 Agentic Search 检索层,以多步检索循环让模型在复杂文档中查找、检视并验证信息,在 FinanceBench 上将正确率从 26.7% 提升至 86%,在 OfficeQA Pro 上从 6.3% 升至 51.9%,p90 延迟最高降低 39.6%,token 消耗最多减少三分之一。
推荐理由:原文用两组基准给出 Agentic Search 相对一次式 RAG 的准确率、token 与延迟对比,可据此判断多步检索循环的收益边界。
Mistral AI 宣布从三方面推进客户的主权 AI:推理的区域控制、开放模型选择以及欧洲算力的长期保障。
Berkeley AI Research 的分析指出,自适应并行推理正成为高效推理扩展的下一个范式——由模型自行决定何时分解子任务、生成多少并发线程并加以协调。