多模态深度调研」共找到 1669 篇相关文章

新闻资讯7

冲击自回归,扩散模型正在改写下一代通用模型范式

Google I/O 2025 开发者大会上,Gemini Diffusion 引发关注,它是采用扩散模型的语言模型。此前已有团队探索扩散式 LLM,如斯坦福、上海 AI 实验室等。蚂蚁集团和人大推出 LLaDA,后发展出多模态模型,国内团队跻身前列。

机器之心
算法论文7

经典ReLU回归!重大缺陷「死亡ReLU问题」已被解决

深度学习领域,经典 ReLU 函数因简洁性等优势受青睐,但有「死亡 ReLU 问题」。德国吕贝克大学等机构研究者引入 SUGAR 方法,不牺牲 ReLU 优势解决该问题,还设计 B - SiLU、NeLU 函数,实验显示性能提升显著。

机器之心
产品应用7

AI全面爆发后,企业正在悄悄争夺知识库入口|甲子光年

AI幻觉问题让企业意识到通用模型在专业场景的局限,需构建企业级知识库。腾讯在峰会上宣布升级知识库产品,乐享知识库通过AI赋能解决数据整合、更新等痛点,未来知识库将与业务深度联动。

甲子光年
新闻资讯8

突发!OpenAI以64亿美元,收购iPhone设计师公司io

今天凌晨1点CNBC消息,OpenAI将以64亿美元全资收购前苹果iPhone设计师乔尼・艾维的AI设备初创公司io,推动其进军硬件领域。艾维将承担深度创意与设计职责,其创意团队Love From保持独立。

AIGC开放社区
新闻资讯7

科大讯飞研发总监王磊磊将在 AICon 上海分享多模态降噪技术的实践与应用

5月23 - 24日AICon上海大会将聚焦AI前沿与产业落地。科大讯飞王磊磊将分享《复杂场景下的语音交互,多模态降噪技术的实践与应用》,介绍基于多模态融合的降噪技术体系及其在智能硬件中的应用。

InfoQ
推荐文章8

GPT-4o图像生成的「核燃料」找到了!万字长文拆解潜在变量,网友:原来AI在另一个维度作画

上月,GPT - 4o图像生成功能爆火。Sander Dielman在博客中探讨生成模型利用潜在空间提高效率和质量,将潜在变量比作「数据精髓」,深入对比多种模型,还介绍训练方法、损失函数等,兼具理论深度与直观洞察。

机器之心
推荐文章8

人工智能驱动的科研新范式及学科应用研究

文章指出AI驱动的科研新范式通过数据、算力、算法深度耦合嵌入科研全过程,引发多方面变革。总结其特征与演化方向,分析学科应用要求与成功案例,还提出我国推动AI科研应用的启示与建议。

力学与人工智能
推荐文章9

快去提问!沐神空降小红书,在线答疑

本文整理了深度学习大牛李沐(沐神)在小红书开展的AMA答疑内容,覆盖AI学习、职业方向、技术趋势、行业赛道等大众关心的热门问题,给出了直白干货的回答,适合AI从业者、学生参考。

机器之心
新闻资讯7

谢尔盖・布林再次进入「创始人模式」?Google押注「AI自我进化」

据路透社报道,Google联合创始人谢尔盖・布林深度介入AI研发,推动递归式自我改进(RSI)方向。此前Google新一代Gemini旗舰模型发布推迟,内部测试显示在关键领域落后对手,此次调整或为提升研发效率。

机器之心
开源动态7

Meta 开源 Brain2Qwerty v2:非侵入式脑机接口语句解码准确率达到 61%

Meta 近日开源非侵入式脑机接口系统 Brain2Qwerty v2,能将人脑想法解码为完整语句,平均单词识别准确率达 61%,远超其他非侵入式方案。其采用三阶段深度学习模型,代码和训练数据已公开。

InfoQ