AI 3D 生成公司 Meshy 不到两年 ARR 突破 1 亿美元
AI 3D 生成初创公司 Meshy 宣布其年度经常性收入(ARR)在不到两年内从 100 万美元增长至 1 亿美元。尽管 GPT-6 等通用模型具备基础 3D 建模能力,但 Meshy 凭精细几何结构与纹理渲染等资产生成优势,成功切入游戏开发与 3D 打印的真实生产流程;同时公司推出实时互动多模态内容架构 Mora,尝试将 3D 从生产资产升级为可交互世界的骨架。
AI 3D 生成初创公司 Meshy 宣布其年度经常性收入(ARR)在不到两年内从 100 万美元增长至 1 亿美元。尽管 GPT-6 等通用模型具备基础 3D 建模能力,但 Meshy 凭精细几何结构与纹理渲染等资产生成优势,成功切入游戏开发与 3D 打印的真实生产流程;同时公司推出实时互动多模态内容架构 Mora,尝试将 3D 从生产资产升级为可交互世界的骨架。
NASA 与 IBM Research 联合发布并开源了 NASA-IBM Lunar Foundation Model,将 17 年的月球轨道观测数据转化为用于月球科学研究的基础模型。
AI 原生影视公司 Utopai Studios 的自研视频生成模型 Utopai X 在评测机构 Artificial Analysis 的带音频文生视频排行榜中位列全球第二。
爱范儿在 MiniMax Code 中使用同一套提示词,对比测试了 MiniMax M3.1 Flash Preview 与 Claude Opus 5.5 在动态设计作品集、水墨短片及交互游戏原型等前端创作任务上的表现。
Google DeepMind 宣布推出新一代前沿 AI 模型 Gemini 4 Argon,主打复杂多步骤工作流,并将单次输出 Token 上限大幅提升至 100 万。
推荐理由:Google 发布前沿大模型 Gemini 4 Argon,将单次生成上限提升至 100 万 Token,主要面向长流程复杂任务、软件工程及网络安全防护。
Hugging Face 宣布推出 Open TTS Leaderboard,旨在为开源及多语种文本转语音(TTS)与声音克隆模型提供可扩展的客观评估基准。榜单使用 Qwen3 ASR 计算字词错率(WER/CER)来评估语音清晰度,通过 WavLM 计算说话人相似度,并在 NVIDIA H200 GPU 与 CPU 上量化 RTFx 推理速度及首块音频时间(TTFA)。
推荐理由:Hugging Face 推出开源 TTS 榜单,通过 WER、推理速度及声音相似度等客观指标弥补人工竞技场评估扩展性不足的问题。
Google DeepMind 正式推出 Gemini 3.8 Live with Live Avatar,为 Gemini 的原生实时对话模型引入低延迟流式视频与数字人形象。
推荐理由:Google DeepMind 为 Gemini 3.8 Live 引入了实时数字人功能,支持实时音视频生成、97 种语言同传以及后台异步工具调用,方便企业构建具备视觉形象的交互智能体。
Google 宣布推出 Gemini 3.8 Flash TTS 和 Gemini 3.8 Flash-Lite TTS 两款语音生成模型,支持通过自然语言提示词自定义角色声音和 30 秒声音复刻。
推荐理由:Google 推出 Gemini 3.8 系列文本转语音模型,支持自然语言定制声音与逐行对话控制,在长音频生成中可减少音色漂移。