跳到正文

全部动态

今日 31 条
9月21日周一
9月18日周五
9月17日周四
  1. GitHub Blog · AI & ML78

    GitHub Copilot运行时迁移至Rust,使用Copilot

    GitHub Copilot运行时从TypeScript重写为Rust,由AI代理主导完成,超过80万行Rust代码。迁移过程实现了性能提升和跨产品共享运行时。

    推荐理由:原文详细记录了使用Copilot代理将GitHub Copilot运行时从TypeScript迁移至Rust的过程,性能提升显著,并实现了多产品共享。

9月16日周三
9月11日周五
9月10日周四
  1. Mistral AI39

    Cloudera 与 Mistral 达成合作,为企业数据带来专业化主权智能

    Mistral 与 Cloudera 达成合作,将 Mistral 模型集成进 Cloudera 混合数据平台,支持在私有云、公有云、本地及完全气隙环境部署推理并保持控制。企业还可在受控环境用专有数据训练自有模型并保留数据与智能所有权,面向主权 AI 需求。Mistral 提到 Cloudera 平台承载 30 exabytes 客户管理数据。

9月8日周二
  1. Google DeepMind71

    Google DeepMind 发布 AlphaGenome Atlas:人类基因组中每种可能 DNA 字母变化的预测地图

    Google DeepMind 发布了 AlphaGenome Atlas,提供人类基因组中 90 亿个单核苷酸变异的分子影响预测。该平台包含数千个分子效应预测,覆盖多个细胞类型,已在罕见病研究中验证变异功能。AlphaGenome Atlas 通过网站、AlphaGenome API 和 Google Antigravity 提供。

    推荐理由:Google DeepMind 发布了 AlphaGenome Atlas,提供人类基因组中 90 亿个单核苷酸变异的分子影响预测,并推出 AVI 分数用于变异影响评估。

  2. Mistral AI66

    Mistral 完成 30 亿欧元 D 轮融资,投后估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元,由三星电子领投,Scaleup Europe Fund 和 PSG Equity 联合领投。Mistral 称这是欧洲科技公司完成的规模最大的股权融资,资金将用于扩展前沿研究、算力容量、基础设施以及商业化与国际业务。公司目前在 20 个国家运营,服务 125+ 家全球企业,包括 Airbus、ASML 和 HSBC。

    推荐理由:融资规模与投资方结构显示欧洲主权 AI 路线的资本支持力度,可用于对照 Mistral 全栈开源布局的商业方向。

9月7日周一
9月4日周五
9月3日周四
  1. Google DeepMind70

    Google DeepMind 发布 Gemini 3.8 Flash 与 3.8 Flash Cyber

    Google DeepMind 发布 Gemini 3.8 Flash 和 Gemini 3.8 Flash Cyber,前者延续 3.7 Flash 的速度与定价(每百万输入 token 0.75 美元、每百万输出 token 3.75 美元),在软件工程、智能体任务和多步推理上明显提升。

    推荐理由:3.8 Flash 在相同价格下把提升集中在长周期编码与智能体任务,读者可据此判断是否替换现有生产模型。

9月2日周三
9月1日周二
  1. Google Research62

    Google 发布 TimesFM-3,支持多变量零样本时间序列预测

    Google Research 发布 TimesFM-3 时间序列基础模型,参数量 330M,预训练语料超过 1 万亿个时间点,原生支持多变量预测。模型可在单次前向传播中联合预测多条相关序列并输出 9 个分位数,同时支持历史协变量与已知未来协变量,无需任务级微调。

    推荐理由:相比前代只做单变量预测,TimesFM-3 原生支持多变量与协变量输入,可用于零售、金融等实际预测任务。

8月31日周一
8月28日周五
8月27日周四
8月25日周二
  1. Mistral AI39

    Mistral 与 HUMAIN 宣布战略合作,推进沙特及区域主权 AI

    Mistral 与 HUMAIN 宣布战略合作,覆盖 AI 基础设施、先进模型开发与 AI 解决方案部署,初期聚焦网络安全与语音,并计划开发阿拉伯语表现强劲的前沿模型,合作规模达数亿欧元。Mistral 将探索使用 HUMAIN 的数据中心基础设施,双方还计划在沙特推进联合 go-to-market 策略,面向受监管行业。

8月24日周一
8月21日周五
  1. Google Research35

    Google Research 的 ME-POIs 如何用移动性数据让语言模型更深入理解地点

    Google Research 提出 Mobility-Embedded POIs(ME-POIs)框架,把匿名聚合的移动性模式与 Gemini 的文本嵌入对齐,为地点生成兼顾身份与动态功能的嵌入向量。在公开基准上,该方法在访问意图预测上最高取得 81.9% 的相对提升,价格水平分类提升 75.1%,忙碌度估计准确率提升 24.7%。

8月20日周四
  1. Mistral AI63

    Mistral 发布 Agentic Search 检索层,以多步检索提升复杂文档搜索准确率

    Mistral 发布 Agentic Search 检索层,通过 search、open、navigate、read、grep 五个工具让模型多步检索、打开并核对文档,已集成进 Mistral Search Toolkit 以及 Studio 和 Vibe 的 Libraries。

    推荐理由:原文用 FinanceBench 和 OfficeQA Pro 两组基准对比一次性 RAG 与多步检索循环,读者可借此了解复杂文档检索的取舍。

8月17日周一
8月13日周四
  1. Hugging Face Blog43

    OlmoEarth Studio 新增自定义 embedding 导出,用于下游分析

    OlmoEarth Studio 现支持计算并导出自定义 embedding 向量,输出为 COG,模型权重与源码公开。可选 Nano(128 维,1.4M 参数)、Tiny(192 维,6.2M 参数)或 Base(768 维,89M 参数)编码器,时间跨度 1-12 个月,分辨率 10-80 米。越南 Ca Mau 红树林区仅用 60 个标注像素训练逻辑回归,加权 F1 达 0.84。

  2. Microsoft Research44

    MindTopo 揭示 VLM 的空间推理能力

    微软研究院的新基准 MindTopo 发现,专有与开放权重多模态模型在静态拓扑推理上明显强于交互规划,且都远低于人类。它按连续性、分离、顺序、包围和绳结五类,测试静态场景问答,以及模拟环境中须维持或改变关系的动作规划。规划失败常在理解场景之后出现,模型失去对结构关系的追踪,或提出违反环境约束的动作。

8月11日周二
8月10日周一
  1. Import AI63

    Import AI 468:23 个 RSI 政策想法、PostTrainBench+ 以及信任与透明度如何影响 AI 竞赛

    Import AI 468 分析了 23 个关于递归自改进的低风险政策建议,包括提供透明度、风险管理策略和国际合作等七大类别。作者还讨论了游戏理论论文 Racing to Ruin 如何通过信任和透明度实现 AI 竞赛的稳定协调,以及 PostTrainBench 基准上 AI 系统自动化 R&D 表现优于人类基线的事实。

8月6日周四
8月4日周二
  1. Mistral AI59

    Mistral AI 发布 3B 开源多模态安全分类器 Shieldstral

    Mistral AI 发布 Shieldstral,一个 3B 开源权重多模态安全分类器,以 Apache 2.0 许可开放下载。它把内容审核建模为推理时传入纯语言策略的问答任务,无需重新训练即可适配新策略,在文本安全上匹配最高 7 倍规模的开源 guard 模型,并在多模态审核上刷新 SOTA。模型可在单张 16GB NVIDIA GPU 上运行。

7月30日周四
  1. Google DeepMind48

    Google 在 Flow Music 上线 Lyria 3.5,升级音乐性、歌词、人声与创作控制

    Google 在 Flow Music 中上线新一代音乐生成模型 Lyria 3.5,在音乐性、歌词、人声质量和创作控制四方面带来提升。该模型可生成更复杂自然、旋律结构更丰富的作品,歌词的提示词遵循与结构意识更好,人声更具情感表现力且发音改善,用户还能更便捷地控制输出节奏与时长。