跳到正文
10月2日周五
  1. Hugging Face Blog63

    Ai2 开源科学报告生成模型 AstaBrief 8B 并上线 Asta 平台

    艾伦人工智能研究所开源了基于 Qwen3-8B 微调的科学报告生成模型 AstaBrief 8B,并在科研 AI 平台 Asta 中作为 Fast 模式上线。该模型基于 9 万条真实科研查询构建数据集,结合 SFT 与 DPO 训练并简化全篇生成管道,生成速度比 Claude 驱动的 Thinking 模式提升约 3.5 倍。模型权重、训练数据与本地部署工作流已全量开源,方便机构在自有设施上运行。

    推荐理由:Ai2 开源了基于 Qwen3-8B 的科学报告生成模型,通过 SFT 与 DPO 优化实现单次全篇生成,在大幅提升生成速度的同时保持了引用准确度。

  2. Hugging Face Blog41

    AutoSynthData:为企业智能体生成训练数据

    ServiceNow CoreAI 提出 AutoSynthData 框架,旨在将目标模型的失败记录转化为企业智能体的训练数据。该框架分析目标模型的缺陷与强教师模型的成功经验并生成能力规范卡,以此自动构建包含系统规范、用户提示词及验证器的可执行任务。生成任务经验证后用于后训练,随着模型提升自动将课程重心转向后续瓶颈。

10月1日周四
  1. Simon Willison56

    Matthew Green 探讨 AI Agent 跨沙盒传播的蠕虫安全隐患

    密码学家 Matthew Green 指出,即使 AI Agent 运行在独立沙盒中,也可能通过共享包缓存或 Slack、邮件等通信管道传递恶意指令,形成跨 Agent 传播的蠕虫攻击。测试显示,沙盒内的 Agent 可在共享缓存中留下改变其他 Agent 行为的指令;若将该机制引入个人 Agent 部署场景,将具备网络蠕虫扩散的关键要素。

  2. Google DeepMind83

    Google 发布前沿 AI 模型 Gemini 4 Argon

    Google DeepMind 宣布推出新一代前沿 AI 模型 Gemini 4 Argon,主打复杂多步骤工作流,并将单次输出 Token 上限大幅提升至 100 万。

    推荐理由:Google 发布前沿大模型 Gemini 4 Argon,将单次生成上限提升至 100 万 Token,主要面向长流程复杂任务、软件工程及网络安全防护。

9月30日周三
  1. Google DeepMind56

    Google DeepMind 推出合成生物学水印技术 SynthID Bio

    Google DeepMind 推出 SynthID Bio 技术,可将不可见水印嵌入 AI 生成的蛋白质氨基酸序列与 3D 结构中,在湿实验测试中保持了蛋白质的生物学功能。该技术已应用于 ProteinMPNN、AlphaFold 3 以及 Evo 2 模型,旨在协助 DNA 合成机构自动化审查生物风险并维护数据库真实性,相关方法与代码已向研究社区开源。

  2. Hugging Face Blog66

    Hugging Face 推出开源 TTS 榜单,提供多语种与声音克隆客观评估

    Hugging Face 宣布推出 Open TTS Leaderboard,旨在为开源及多语种文本转语音(TTS)与声音克隆模型提供可扩展的客观评估基准。榜单使用 Qwen3 ASR 计算字词错率(WER/CER)来评估语音清晰度,通过 WavLM 计算说话人相似度,并在 NVIDIA H200 GPU 与 CPU 上量化 RTFx 推理速度及首块音频时间(TTFA)。

    推荐理由:Hugging Face 推出开源 TTS 榜单,通过 WER、推理速度及声音相似度等客观指标弥补人工竞技场评估扩展性不足的问题。

9月29日周二
  1. Hugging Face Blog76

    NVIDIA 推出开源表格基础模型 Kumo Tabular

    NVIDIA 推出开源表格基础模型 Kumo Tabular,无需微调或特征工程即可通过单次前向传播完成表格数据的分类与回归预测。该模型完全通过合成数据预训练,提供 28M 至 215M 三种参数规模,并在 TabArena 等四个基准榜单中取得综合排名第一。

    推荐理由:该模型无需微调与特征工程,通过上下文学习在单次前向传播中完成表格预测,为结构化数据处理提供了新范式。

9月28日周一
  1. Mistral AI55

    Mistral AI 在德国慕尼黑开设新中心,推进物理与工业 AI 布局

    Mistral AI 宣布在德国慕尼黑开设全新研发中心,聚焦物理 AI 与工业 AI 领域,并计划到 2030 年构建 1 吉瓦的欧洲算力设施。该中心依托开放权重架构提供本土化算力与企业级部署,目前已与宝马开展碰撞模拟研究,并与西门子能源及慕尼黑工业大学展开深入合作。

9月25日周五
  1. Google DeepMind78

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 正式推出 Gemini 3.8 Live with Live Avatar,为 Gemini 的原生实时对话模型引入低延迟流式视频与数字人形象。

    推荐理由:Google DeepMind 为 Gemini 3.8 Live 引入了实时数字人功能,支持实时音视频生成、97 种语言同传以及后台异步工具调用,方便企业构建具备视觉形象的交互智能体。

9月24日周四
  1. Google DeepMind51

    Google 升级 Private AI Compute 架构,实现端侧隐私级别的云端持久 AI 记忆

    Google 团队发布 Private AI Compute 架构更新,为其 AI 平台引入基于服务端的安全持久记忆功能。该架构通过硬件级安全区与端到端加密,将解密密钥仅保存在用户设备上,使云端 AI 能够跨设备保留上下文且包括 Google 在内的第三方均无法调阅,同时官方已发布白皮书并完成了第三方安全审计。

9月23日周三
9月16日周三
  1. Mistral AI61

    Mistral 宣布与 Mozilla 合作,为 Firefox Smart Window 浏览助手提供模型支持

    Mistral 宣布与 Mozilla 达成合作,其大模型现已接入 Firefox 的 AI 浏览助手 Smart Window(beta),帮助用户解析复杂搜索并基于网页标签页提炼信息。该功能首先面向法国和北美用户开放,英国和德国预计将在今年晚些时候跟进。此外,双方承诺注重隐私保护,对话默认不保存在 Mozilla 服务器,Mistral 也遵循零数据留存协议。

    推荐理由:Mistral 模型已接入 Firefox 浏览助手,首先面向法国和北美用户开放且承诺零数据留存。

9月10日周四
  1. Mistral AI37

    Cloudera 与 Mistral 达成合作,为企业数据带来专用主权智能

    Cloudera 与 Mistral 宣布合作,将 Mistral 模型集成至 Cloudera 混合数据平台,支持企业在公有云、私有云、本地及隔离环境中部署与推理。企业可利用自有专有数据训练定制 AI 模型,完全掌控数据、计算资源与模型所有权,满足对主权 AI 的需求。该合作将覆盖 Cloudera 平台上管理的 30 EB 客户数据。

9月9日周三
9月8日周二
  1. Mistral AI75

    Mistral 完成 30 亿欧元 D 轮融资,估值超 210 亿欧元

    Mistral 宣布完成 30 亿欧元 D 轮融资,投后估值超过 210 亿欧元。本轮融资由三星电子领投,Scaleup Europe Fund 与 PSG Equity 联合领投,NVIDIA、a16z、BlackRock 管理基金等参投。资金将用于扩充训练算力储备、拓展基础设施与国际业务,并推进涵盖开源权重模型与私有化部署的主权 AI 全栈研发。

    推荐理由:Mistral 完成 30 亿欧元 D 轮融资,由三星电子领投且估值超 210 亿欧元,资金将用于扩展算力与推进主权开源 AI 研发。