零转全驱」共找到 2237 篇相关文章

新闻资讯8

阿里一口气发了N款新模型,让我们向源神致敬。

阿里云栖大会发布众多模型,有Qwen3 - Max、Wan2.5等。Qwen3 - Max对标顶尖模型;Wan2.5支持音画同出;Qwen3 - VL是强大视觉语言模型且已开源;Qwen3 - Omni是模态模型。此外还有多个新模型,构建场景生态。

开源星探
算法论文8

“掩码即武器”,四款扩散LLM部破防 ? 上交&上海AI Lab发现dllm致命安缺陷

上海交通大学、上海人工智能实验室等团队研究指出,扩散语言模型(dLLMs)有根本性架构安缺陷。他们提出DIJA攻击框架,能让多个dLLMs大概率生成有害内容,还呼吁从多方面加强dLLM安

深度学习自然语言处理
算法论文8

Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用部token训练还好

Qwen与清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。

量子位
8

陶哲轩对谈 OpenAI 高管:“试错成本”无限趋,AI 正在把数学变成一门重工业

菲尔兹奖得主陶哲轩与OpenAI顶尖科学家Mark Chen对谈,探讨AI在数学研究中的能力、缺陷与演化路径。指出AI试错成本低,在数学领域发展潜力大,虽目前有局限,但正改变数学研究方式。

AI科技大本营
产品应用8

奥特曼重磅发声:AI公司是未来!OpenAI官宣Frontier,让管理Agent像管人一样简单

OpenAI推出智能体中枢平台Frontier,可整合企业系统与数据,让智能体稳定运行。目前Anthropic在企业级大模型市场份额领先,OpenAI想借Frontier卡位。该平台已获多家巨头试用,有望拉开AI扎根企业核心业务时代序幕。

InfoQ
开源动态8

告别“音画割裂”与“人物崩坏”!AutoMV:首个听懂歌词、卡准节拍的开源曲级MV生成Agent

现有AI视频生成模型做曲MV有时长限制、音画割裂和一致性差等问题。AutoMV作为开源多智能体系统,模拟人类影视制作流程,能生成长达数分钟、叙事连贯且音画同步的完整MV。

量子位
开源动态8

还在花钱语音?10,000+ star 开源「ebook2audiobook」白嫖1107种语言!免费文字秒变多语言音频!

`ebook2audiobook` 是由 Drew Thomasson 主导、13k+ Stars 的开源工具,能将电子书无缝换为有声书,支持 1107+ 语言,有章节拆分、多 TTS 引擎支持等功能,低门槛部署,适合多场景。

小华同学ai
推荐文章8

一文带你彻底搞懂!企业级MCP Server接入OAuth授权服务器流程解析(含完整代码)

文章从基础概念入手,借Python + MCP SDK + 第三方授权示例,解析企业级MCP Server接入OAuth授权服务器流程,包含OAuth 2.0概念、MCP支持架构、Google OAuth2.0认证实战及与其他安方案配合。

AI大模型应用实践
产品应用8

阿里电影级视频模型万相2.6系列上线,功能比Sora2还,人人都能当导演

12月16日,阿里发布通义万相2.6系列模型,5款新模型同时上线,覆盖图像到视频多环节。它是国内首个支持角色扮演的视频模型,功能比Sora2,已上线阿里云百炼和万相官网。

AI前线
产品应用8

字节Seedream 4.0将量开放!抢先评测来了,我们摸索出AI生图20种「邪修」玩法

近日,字节跳动内测豆包・图像创作模型 Seedream 4.0,支持多模态生图,核心能力显著提升。它将量上线并开放给企业客户。实测显示其多模态融合出色,还与谷歌 Nano Banana 对比,各有优势。

机器之心