AI 日报 · 2026 年 10 月 7 日 · 星期三
MYHOT
Mistral 发布 Mistral Large 4 公开预览版
Mistral 发布 Mistral Large 4 的公开预览版,这是一款 1 trillion-parameter 原生多模态模型,包含 49 billion active parameters,可通过 Mistral Studio 的 API 试用。模型权重计划于本月底发布;文中还列出其在编码、智能体工作流、多模态理解及安全评测中的表现。
模型发布/更新
Google DeepMind 发布多模态嵌入模型 EmbeddingGemma 2
Google DeepMind 发布 EmbeddingGemma 2,将文本、代码、图像、视频和音频映射到统一嵌入空间,供端侧多模态搜索与检索使用。模型基于 Gemma 4 架构,拥有 740 million parameters,并采用 Apache 2.0 license;其上下文窗口为 8K token,输出向量可从 768 维截断至 512、256 或 128 维。
Google 发布图像生成与编辑模型 Nano Banana 2.1,价格约减半
Google 发布图像生成与编辑模型 Nano Banana 2.1,取代 2026 年 2 月发布的 Nano Banana 2,价格约减半。1K 图像价格从 6.70 cents 降至 3.36 cents,4K 图像从 15.10 cents 降至 7.56 cents;模型支持 1K、2K 和 4K 分辨率,并已开始在 Google 产品中推出。
Falcon-Emirati-7B 阿联酋方言大语言模型发布
Technology Innovation Institute 发布 Falcon-Emirati-7B,一款基于 Falcon-H1-Arabic、面向阿联酋阿拉伯语方言的 7B 模型,可在 Falcon Chat 使用。在 Alyah 基准上得分为 84.83%,在阿联酋文化理解任务上得分为 85.57%;评估还包括开放式生成、LLM 评审和阿联酋母语者审阅。
Reflection 发布 Beam 501B-A23B 开放权重模型
Reflection 发布了 Beam,一款面向编码、智能体和科学工作的纯文本 MoE 模型,总参数量为 501B、激活参数量为 23B,并从头训练。Reflection 称其预训练使用 23.8T tokens,并报告 SWE-bench Verified 得分为 80.9;完整权重预计本月以 Apache 2.0 许可发布。
论文研究
Google Research 发布 Earth AI 地理空间基础模型在全球公共卫生中的评估
Google Research 介绍了 Earth AI 的 Population Dynamics Foundation Model(PDFM),并通过五类公共卫生任务评估其地理嵌入对现有流行病学模型的补充作用。
OpenAI 发布内部前沿模型解决数学开放问题的新结果并公开 Lean 证明形式化
OpenAI 发布了内部前沿模型在数学开放问题上的新结果,并在 GitHub 分享 Lean 证明形式化和研究细节。
技巧与观点
如何用 AgentCore 和 OpenClaw 构建具备上下文记忆的 AI 助手
文章展示如何基于 Amazon Bedrock AgentCore 和 OpenClaw 构建能跨对话积累上下文的 AI 助手,并以园艺助手 Sprout 为例说明部署架构。系统将对话存为短期事件,通过异步提取生成长期偏好、语义事实和会话摘要,再用命名空间与结构化元数据检索相关记忆;轻量个人使用成本约为每月 $5–9(截至 2026 年 7 月)。
如何用 Amazon Bedrock AgentCore、Managed Knowledge Base 和 Nova Sonic 构建语音旅行助手
文章展示如何在 AWS 航空应用中构建语音旅行助手,使用 Amazon Bedrock AgentCore、Amazon Nova 2.5 Sonic 和 Amazon Bedrock Knowledge Bases。方案通过 MCP 连接后端服务,可处理行程查询、座位与餐食偏好变更、航班状态和政策问题,并支持转接人工客服;文章还介绍了架构、AWS CDK 部署及清理步骤。