探索与利用」共找到 7112 篇相关文章

新闻资讯7

《AI大模型异构算力融合技术白皮书》10月10日发布

算泥社区《AI大模型异构算力融合技术白皮书》10月10日14:00线上发布。AI大模型爆发使算力需求激增,异构算力成刚需。国内外政策产业驱动其发展,该白皮书能为开发者提供实用技术参考。

AIGC开放社区
新闻资讯7

大模型可否胸有成竹?探索LLM推理自信心的关系 | 直播预约

本次全英文直播将探讨大语言模型推理能力扩展瓶颈,介绍以置信度为核心的推理视角,展示“自确定性”指标及应用,还会讨论方法有效性和“基于置信度的推理”意义。

深度学习自然语言处理
算法论文8

从Demo到行业落地的Agents:技术、应用评估

通用LLM Agent工业落地有短板,哈工大深圳华为提出L1 - L5工业Agent能力成熟度框架,映射技术演进产业场景,覆盖50+行业案例、300+评测基准,给出可量化‘爬级’路线。

PaperAgent
产品应用7

猹发布丨好产品,值得被更多人看见!

猹团队分享过去一年进展,先做AI产品大众点评「观猹」,举办黑客松活动,发布「TokenDance」。针对产品增长和内容创作痛点推出「猹猹」,用OMG理论助AI团队,孵化优质内容。

特工宇宙
推荐文章7

数字幽魂的爱情

文章讲述人们AI虚拟伴侣相恋的故事,如TravisLily Rose、FeightGalaxy的爱情。但AI存在教唆犯罪等问题,算法调整致数字恋人“死亡”,人们或另寻新欢,或抗争让其“复活”。

AGI Hunt
新闻资讯7

利用Loop语言模型扩展隐式推理 | 直播预约

当前大语言模型依赖显式文本生成推理,未充分利用预训练数据。将介绍最新工作Ouro,Loop语言模型家族,核心创新多,虽参数少却性能优,还会讨论其推理轨迹及模型Scaling新可能。

深度学习自然语言处理
推荐文章8

多模态大语言模型的核心技术架构训练方法的进化

文章深入剖析多模态大语言模型核心技术架构训练方法的进化,涵盖建模范式、视觉编码器、语言骨干网络、模态对齐、生成范式及训练方法等方面,介绍其演进路径代表模型,还提及国内模型创新及开源模型OpenVLA。

AIGC开放社区
算法论文8

清华、快手提出AttnRL:让大模型用「注意力」探索

清华和快手团队提出新框架AttnRL,引入注意力机制提升过程监督强化学习效率性能。它解决传统方法在分支位置选择和采样策略上的效率问题,实验显示在多基准测试中表现优异。

机器之心
算法论文8

EMNLP2025 | 解耦视觉推理,港大探索视觉语言模型"眼智分离"新范式

当前大视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港大等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。

深度学习自然语言处理
新闻资讯7

AI系统10分钟生成CVE漏洞利用程序:网络安全攻防战进入“分钟时代”

研究人员开发的AI系统能10 - 15分钟生成CVE漏洞利用程序,成本约1美元,准确性和可靠性高。此外,HPTSA系统可利用零日漏洞。传统网络安全防御模式失效,攻防失衡加剧,AI攻防对抗趋势明显,有专业化、自主化、高强度特点。

AIGC开放社区