跳到正文
  1. Hugging Face Blog63

    Ai2 开源科学报告生成模型 AstaBrief 8B 并上线 Asta 平台

    艾伦人工智能研究所开源了基于 Qwen3-8B 微调的科学报告生成模型 AstaBrief 8B,并在科研 AI 平台 Asta 中作为 Fast 模式上线。该模型基于 9 万条真实科研查询构建数据集,结合 SFT 与 DPO 训练并简化全篇生成管道,生成速度比 Claude 驱动的 Thinking 模式提升约 3.5 倍。模型权重、训练数据与本地部署工作流已全量开源,方便机构在自有设施上运行。

    推荐理由:Ai2 开源了基于 Qwen3-8B 的科学报告生成模型,通过 SFT 与 DPO 优化实现单次全篇生成,在大幅提升生成速度的同时保持了引用准确度。

  1. Google DeepMind83

    Google 发布前沿 AI 模型 Gemini 4 Argon

    Google DeepMind 宣布推出新一代前沿 AI 模型 Gemini 4 Argon,主打复杂多步骤工作流,并将单次输出 Token 上限大幅提升至 100 万。

    推荐理由:Google 发布前沿大模型 Gemini 4 Argon,将单次生成上限提升至 100 万 Token,主要面向长流程复杂任务、软件工程及网络安全防护。

  1. Hugging Face Blog76

    NVIDIA 推出开源表格基础模型 Kumo Tabular

    NVIDIA 推出开源表格基础模型 Kumo Tabular,无需微调或特征工程即可通过单次前向传播完成表格数据的分类与回归预测。该模型完全通过合成数据预训练,提供 28M 至 215M 三种参数规模,并在 TabArena 等四个基准榜单中取得综合排名第一。

    推荐理由:该模型无需微调与特征工程,通过上下文学习在单次前向传播中完成表格预测,为结构化数据处理提供了新范式。

  1. Google DeepMind80

    Google 发布 Gemini 3.8 Flash TTS 与 Flash-Lite TTS 语音生成模型

    Google 宣布推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,支持通过自然语言提示词自定义角色声音和 30 秒声音复刻。

    推荐理由:Google 推出 Gemini 3.8 系列文本转语音模型,支持自然语言定制声音与逐行对话控制,在长音频生成中可减少音色漂移。

已经到底了