跳到正文
  1. AWS Machine Learning Blog78

    GLM 5.3 在 Amazon Bedrock 上线,支持缓存配置与 Strix 安全测试

    AWS 宣布 GLM 5.3 已在 Amazon Bedrock 上提供,企业用户可通过托管 API 调用该模型,并使用跨区域推理、提示词缓存和不同服务层级。文章给出 OpenAI 兼容 API 调用及显式提示词缓存的 Python 示例,还演示了如何将模型接入开源 AI 渗透测试智能体 Strix,对本地 OWASP Juice Shop 执行授权安全测试。

    推荐理由:文章把 GLM 5.3 在 Amazon Bedrock 上的接入方式与缓存配置写成可操作示例,并展示了它在授权安全测试工作流中的用法。

  1. Google Research79

    Google Research 介绍基于 TEE 的联邦学习系统,提升隐私保障与训练效率

    Google Research 介绍了新一代基于可信执行环境(TEE)的联邦学习(FL)系统,通过公开访问策略、可验证执行和差分隐私,增强数据匿名化的可审计性。Gboard 已用该系统部署英语和日语的下一个词预测模型,获得更强隐私保障和更高准确率,训练时间也较以往显著缩短。

    推荐理由:文章梳理了 TEE 如何把访问策略、可审计执行与差分隐私结合起来,并以 Gboard 部署说明这种架构的实际应用。

  2. NVIDIA Blog72

    NVIDIA DGX Spark 推出 64GB 配置,支持双机集群扩展

    NVIDIA DGX Spark 将推出 64GB 配置,面向开发者、研究人员和 AI 爱好者,可在设备本地运行最多 100-billion-parameter 模型。

    推荐理由:64GB 配置覆盖单机本地运行与双机扩展,文中还给出 Qwen 3.8 27B 测试的性能对比和集群接入方式,便于评估扩容路径。

  1. NVIDIA Blog76

    NVIDIA 与 CoreWeave 推出 Vera Rubin 云服务并发布 CoreWeave Forge

    NVIDIA 与 CoreWeave 宣布在 CoreWeave Cloud 提供 NVIDIA Vera Rubin NVL72,并推出模型与智能体训练、评估和改进环境 CoreWeave Forge。

    推荐理由:文章把 Vera Rubin 的生产部署、Vera CPU 测试和 Forge 的训练改进流程放在同一案例中,呈现从推理到持续优化的具体做法。

  2. Hugging Face Blog64

    Hugging Face 推出 Open TTS Leaderboard,多维评测多语言语音合成与音色克隆

    Hugging Face 推出 Open TTS Leaderboard,使用客观指标评测开源 TTS 模型的可懂度、速度和说话人相似度。排行榜支持多语言与音色克隆比较,并提供试听和投票功能;流式性能按首段音频时间(TTFA)衡量,可查看 H200 GPU 和部分 CPU 结果。该排行榜补充而不取代人工偏好评测,评测脚本计划随后开源。

    推荐理由:排行榜将多语言语音合成、音色克隆和流式延迟纳入同一评测框架,并与人工偏好投票互补,呈现开源 TTS 模型比较中的不同维度。

  1. Microsoft Research76

    Microsoft Research 推出面向复杂生物学研究的 AI 系统 Quine

    Microsoft Research 推出 Quine,这是一个结合生物多模态世界模型与交互式研究环境的实验性 AI 研究系统,可连接科学工具、文献、湿实验室和研究人员。

    推荐理由:Quine 将生物多模态世界模型与实验工具及文献连接,并以胰腺癌细胞状态实验展示其筛选候选化合物的研究流程。

  1. Hugging Face Blog72

    Hugging Face Hub 新增 RL Environments 筛选与框架标签

    Hugging Face Hub 为 RL Environments 新增专属筛选,并允许数据集通过框架标签标示兼容性。首批登记 Harbor、Verifiers、OpenEnv 和 NeMo Gym,页面会为每个框架生成运行命令;环境仍以数据集仓库形式托管,框架负责运行。该更新不新增仓库类型、注册中心或注册流程。

    推荐理由:这次更新把 RL 环境作为带兼容性标签的数据集纳入 Hub,集中展示不同框架可加载的任务,并保留各框架运行环境的职责。

  1. Google DeepMind79

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar

    Google DeepMind 推出 Gemini 3.8 Live with Live Avatar,为 Gemini Enterprise 提供带动态视觉形象的实时对话功能。它结合近实时视频生成与语音,支持后台异步调用工具并在对话不中断时处理任务,还可在97种语言间切换。组织可从参考图生成定制化 Avatar,但该功能目前仅向获准的企业开放;音视频输出均嵌入 SynthID 水印。

    推荐理由:该功能结合实时音视频对话与后台异步工具调用,并支持跨97种语言切换,可看出企业对话场景中交互连续性与多语言适配的设计重点。

  1. Google DeepMind72

    Google DeepMind 为 Private AI Compute 增加安全的服务器端记忆

    Google DeepMind 分享了 Private AI Compute 的服务器端持久记忆架构,使 AI 助手能够跨设备保留上下文,同时维持设备端隐私标准。

    推荐理由:文章说明了 Private AI Compute 如何借助设备持有的密钥与云端安全 enclave 保存跨设备记忆,并提供软件公开记录、技术白皮书和独立审计结果供外界审查。

  1. Google DeepMind87

    Google DeepMind 推出 AlphaGenome Atlas 基因组变异预测平台

    Google DeepMind 推出 AlphaGenome Atlas,收录人类基因组约 9 billion 个单核苷酸变异的预测结果,并面向学术研究开放。平台提供 AlphaGenome Variant Impact(AVI)分数,帮助研究者排序变异并查看其分子效应;可通过网站、AlphaGenome API 和 Google Antigravity 的技能使用。

    推荐理由:AlphaGenome Atlas 将 AlphaGenome 的全基因组预测整理为可检索资源,并以 AVI 分数连接变异排序与分子效应解释,展示了其在遗传研究中的用法。

  1. Mistral AI73

    Mistral 推出区域推理端点、优先服务等级并扩展第三方开放模型支持

    Mistral 宣布三项推进 AI 主权的举措,包括增强区域推理与服务可靠性、支持第三方开放模型,以及汇集企业和机构承诺以保障欧洲长期算力。Mistral Regional Endpoints 已全面开放,客户可选择在欧洲或美国进行推理;Mistral Priority Tier 处于公开预览阶段,为关键任务提供承诺服务等级和正常运行时间 SLA。

    推荐理由:文章把区域推理、第三方开放模型接入与欧洲算力承诺放在同一框架中,具体说明了企业获得区域合规和模型选择的路径。

已经到底了