3D资产生成」共找到 3907 篇相关文章

产品应用8

阿里发布Qwen3-TTS:跨语言混合无缝切换,方言音色全面覆盖!

TTS技术从单一合成进化到多模态表达,但传统模型在跨语言/方言混合场景有不足,商业工具费用高且不开源,开源方案训练数据少。阿里推出Qwen3 - TTS,实现人类级自然度和表现力,功能强大,应用场景多。

开源星探
开源动态7

数学编码超越O3-high,英伟达版「DeepSeek R1二代」推理模型开源~

Nvidia开源OpenReasoning-Nemotron系列模型合集,采用Qwen2.5架构,基于500万条轨迹训练。评测输出长度最高64K token,多版本刷新SOTA。其‘heavy’模式有独特能力,32B版在数学与编程基准超越O3(High)。

PaperAgent
产品应用8

刚刚,Qwen3.8-Flash震撼发布,我们看到了Qwen4的骨架

8月大模型厂商多上调API价格或收缩免费额度,因推理需求增长跑赢算力供给。阿里发布Qwen3.8-Flash并开源,成绩亮眼且价格低。它是Qwen4架构预演,有四大技术创新,提升了模型效率。

机器之心
新闻资讯7

17万白领岗消失!Scale AI最新研究:AI仅动用了3%实力

新智元报道,近期多家巨头裁员17万,AI成“罪魁祸首”。但Scale AI和Center for AI Safety研究指出,全球六大顶尖AI自动化率不到3%,新基准RLI评估显示其执行有经济价值项目能力有限。

新智元
产品应用7

Google Nano Banana 与 GPT-4o Image 1:哪款 AI 图像生成更好?

2025年8月26日,Nano Banana发布引关注,而GPT - 4o Image 1是主流常用图像生成器。文章从关键指标、生成速度对比二者,又用相同提示词在多种场景对比,分析各有优劣,适用场景不同。

MCP Server
开源动态8

王兴一鸣惊人!美团首个开源大模型追平DeepSeek-V3.1

美团首个开源大模型Longcat-Flash-Chat发布即引发热议。它在部分benchmark上超DeepSeek-V3.1等,编程能力也出色。技术报告透露美团对大模型的理解,还有新发现,且性能好、训练效率高。

量子位
新闻资讯8

谷歌用Gemini 3同时革了OpenAI和英伟达两家的命

谷歌发布Gemini 3全家桶,打断英伟达和OpenAI双赢美梦。它实现原生多模态,对OpenAI构成代际优势;用TPU训练模型,摆脱CUDA依赖,冲击英伟达算力神坛。谷歌全栈自研,其发展或改变AI格局。

新智元
算法论文8

DeepSeek-GRPO重要性权重设计错误?详解Qwen3新强化学习算法GSPO

论文指出GRPO在大语言模型训练中不稳定,因其重要性权重设计错误易引入高方差噪声。为此提出GSPO算法,从序列维度计算梯度,解决了MoE模型RL训练的稳定性问题,在Qwen3上效率更高。

深度学习自然语言处理
开源动态7

谢赛宁也玩MC?开源全新世界模型生成多人一致的游戏视角

电子游戏推动AI发展,谢赛宁团队探索世界模型新方向,推出多人视频世界模型Solaris。该模型能生成多人一致的第一视角,团队还搭建了多人数据采集系统SolarisEngine,构建了多人Minecraft数据集。实验结果显示,其方法在多方面表现更优。

机器之心
算法论文8

10万token自然语言推理,让30B-A3B模型站上奥赛金牌线

上海人工智能实验室报告显示,30B - A3B规模的SU - 01模型不依赖外部工具,经训练在IMO、USAMO、IPhO等奥赛评测达金牌水平。研究还验证更高效科学推理系统路线,有望用于更多科学问题。

机器之心