跳到正文
10月5日周一
  1. 量子位53

    AI 3D 生成公司 Meshy 不到两年 ARR 突破 1 亿美元

    AI 3D 生成初创公司 Meshy 宣布其年度经常性收入(ARR)在不到两年内从 100 万美元增长至 1 亿美元。尽管 GPT-6 等通用模型具备基础 3D 建模能力,但 Meshy 凭精细几何结构与纹理渲染等资产生成优势,成功切入游戏开发与 3D 打印的真实生产流程;同时公司推出实时互动多模态内容架构 Mora,尝试将 3D 从生产资产升级为可交互世界的骨架。

10月4日周日
10月3日周六
10月2日周五
10月1日周四
  1. Google DeepMind83

    Google 发布前沿 AI 模型 Gemini 4 Argon

    Google DeepMind 宣布推出新一代前沿 AI 模型 Gemini 4 Argon,主打复杂多步骤工作流,并将单次输出 Token 上限大幅提升至 100 万。

    推荐理由:Google 发布前沿大模型 Gemini 4 Argon,将单次生成上限提升至 100 万 Token,主要面向长流程复杂任务、软件工程及网络安全防护。

9月30日周三
  1. Hugging Face Blog66

    Hugging Face 推出开源 TTS 榜单,提供多语种与声音克隆客观评估

    Hugging Face 宣布推出 Open TTS Leaderboard,旨在为开源及多语种文本转语音(TTS)与声音克隆模型提供可扩展的客观评估基准。榜单使用 Qwen3 ASR 计算字词错率(WER/CER)来评估语音清晰度,通过 WavLM 计算说话人相似度,并在 NVIDIA H200 GPU 与 CPU 上量化 RTFx 推理速度及首块音频时间(TTFA)。

    推荐理由:Hugging Face 推出开源 TTS 榜单,通过 WER、推理速度及声音相似度等客观指标弥补人工竞技场评估扩展性不足的问题。

9月25日周五
  1. Google DeepMind78

    Google DeepMind 发布 Gemini 3.8 Live with Live Avatar

    Google DeepMind 正式推出 Gemini 3.8 Live with Live Avatar,为 Gemini 的原生实时对话模型引入低延迟流式视频与数字人形象。

    推荐理由:Google DeepMind 为 Gemini 3.8 Live 引入了实时数字人功能,支持实时音视频生成、97 种语言同传以及后台异步工具调用,方便企业构建具备视觉形象的交互智能体。

9月23日周三