Mirror Particle 正在构建人类行为的"世界模型"
Mirror Particle 正在从零构建一个模拟人类行为动机与变化的"世界模型"基础模型,以替代依赖 LLM 角色扮演预测人群行为的做法。该引擎整合客户数据、时事、流行文化与社交媒体,聚焦人们实际做出的"揭示性行为",并为品牌解释预测背后的动机。
Mirror Particle 正在从零构建一个模拟人类行为动机与变化的"世界模型"基础模型,以替代依赖 LLM 角色扮演预测人群行为的做法。该引擎整合客户数据、时事、流行文化与社交媒体,聚焦人们实际做出的"揭示性行为",并为品牌解释预测背后的动机。
Mistral AI 发布多模态大模型 Mistral Large 4(ML4,昵称 Le Chonk),参数量达 1T,目前仅能通过公开护栏端点访问,计划在三周内完成安全测试后开放权重。ML4 完全使用 Mistral 自有算力训练,仅动用 4000 块 Nvidia GPU,官方称比中国竞争对手少两到三倍;基准结果尚未公布,优化方向包括网络安全、金融与芯片设计。
Mistral AI 发布 Mistral Large 4(ML4)公开预览,1 万亿参数、490 亿活跃参数的原生多模态模型,为其迄今最大最强模型。权重将于本月底开放,模型在 Mistral 自有欧洲数据中心基于 3,800 块 NVIDIA Grace Blackwell GPU 完成训练。
推荐理由:官方公布 ML4 在网络安全、编码与多模态基准上与闭源模型的对比数据,读者可据此判断开放权重模型的当前位置。
韩国计划通过政府参股投资 4.7 万亿韩元(34.9 亿美元)开发国产前沿 AI 模型,相关资金列入拟议中的 2027 年预算,仍需议会批准。第二条资金线将推动韩国自研模型在全国各行业落地,政府将面向初创企业开放新一轮竞争,LG AI Research、SK Telecom 与 Upstage 的现有入围者不会自动获得追加资金。
PhAI Labs 联合 Stanford、Oxford、Princeton 的研究团队提出 JEPA-Anything,把 JEPA 的预测状态拆成四个正交因子、各自配备预测模块后再重组,以避免简单模式淹没困难模式。
Ai2 开源 AstaBrief 8B,它把研究问题与检索到的文献片段直接转成带引用的报告,训练数据一并开放。模型基于 Qwen3-8B,用 SFT 加 DPO 训练;在 Asta 的 Fast mode 下平均 51.1 秒生成一份报告,约为 Claude 驱动的 Thinking mode(178.5 秒)速度的 3.5 倍。
推荐理由:原文给出一条可迁移的训练经验,用引用密度这一简单信号过滤合成数据,比更复杂的过滤组合更有效。
Google Research 宣布新一代联邦学习系统,利用可信执行环境(TEE)提供完全可验证、可审计的数据匿名化保证,Gboard 已率先采用。新系统由客户端加密上传与访问策略、基于 RAFT 共识的 KMS 密钥管理、用 Federated Language 编排的 TEE 训练循环以及加密恢复状态协同工作,训练时间从此前的 1-2 个月大幅缩短,同时模型准确率提升。
推荐理由:原文对比了新旧联邦学习系统在隐私可验证性与训练效率上的差异,读者可了解 TEE 如何移除对服务器运营方的信任依赖。
NVIDIA 发布开源表格基础模型 Kumo Tabular,输入带标签的表格后可在一次前向传播中预测新行标签,无需训练、微调或特征工程,支持分类与回归。
推荐理由:原文给出四项基准的排名与推理速度对比,读者可据此判断它相对调参梯度提升树和同类表格基础模型的位置。
NVIDIA 联合 Google DeepMind、EMBL-EBI 等机构,在 AlphaFold Database 中开放 2800 多种病毒的蛋白复合体预测三维结构,约 30% 的蛋白相互作用为科学界此前未记录。
推荐理由:开放数据集与 BioNeMo 结构预测流程的发布,让研究者能针对自选病毒蛋白靶点批量预测三维结构,降低实验成本。
Google Research 推出 MilleMiglia,一个用 C++ 编写的中间里程物流实例生成器,可生成现实且保护隐私的基准数据。该工具旨在解决中间里程优化研究缺乏公开高质量数据的问题,将配送建模为时空图上的多商品流问题。源代码和文档已在 GitHub 开源。
Google Research 在 ICML 2026 论文中提出 Retrieve-for-Train 框架,用离线 RL 将数据库感知的查询分解编译为监督信号,推理时无需思考 token 即可单次生成属性对齐的查询扇出。
Google DeepMind 与 Google Research 发布 WeatherNext 3,据 Brightband 独立实时评估为迄今最先进、最准确的全球气象模型。
推荐理由:原文给出了它直接从实时卫星观测学习、逐小时生成 5 公里分辨率预报的技术路线,读者可据此判断 AI 气象预报的能力边界与落地方式。
微软研究院联合华盛顿大学与 Providence 发布开源病理基础模型 GigaPath-Flash 与 GigaTIME-Flash,权重与代码以 Apache 2.0 许可在 HuggingFace 开放。
Mistral 与 HUMAIN 宣布战略合作,将在沙特及中东地区推进主权 AI,合作规模达数亿欧元。双方初期聚焦网络安全与语音,计划开发阿拉伯语表现强劲的前沿模型,Mistral 还将探索使用 HUMAIN 的数据中心基础设施支持本地算力需求。两家公司同时计划在沙特推出面向受监管行业的联合市场策略。
多校研究者推出 SPADE 框架,让 LLM 在自博弈中交替生成可执行训练环境并尝试求解,用强模型生成的合成数据反哺模型自身训练。SPADE 在 Qwen3-30B-A3B-Instruct-2507 上经 GRPO 微调后,游戏环境套件平均分达 58.3,较 base 提升 8.1;METR 另分析称 AI 显著加速了网络安全漏洞发现,对数学研究仅有小幅加速,对 AI 研究优化尚无可测加速。
Berkeley AI Research 的分析指出,自适应并行推理正成为高效推理扩展的下一个范式——由模型自行决定何时分解子任务、生成多少并发线程并加以协调。