「视觉语言融合」共找到 2036 篇相关文章
Google推出 AI 科学家:自动编写专家级代码,40个新方法碾压人类 SOTA
Google新发布的AI系统能编写科学软件、发明新方法,结合大语言模型与树搜索技术。在生物信息学、流行病学等多领域超人类最优水平,引发网友对科研影响的讨论。
AI让全人类思维越来越雷同!南加大研究实锤:认知多样性正在被抹平
南加州大学论文指出,AI正让全人类想法和表达同质化,体现在语言、视角和推理三方面。原因包括训练数据有偏差、训练目标求稳、人们过度依赖。研究人员虽在想办法,但效果有限,呼吁勿无节制依赖。
TGRS 2025 | FSConv:空域捕结构+频域提细节,即插即用的特征增强神器
红外小目标检测存在目标小、背景干扰大难题,传统卷积易丢失特征信息。TGRS 2025论文提出FSConv模块,通过双域融合提升特征表达能力,具备多尺度特征保持、轻量化、自适应增强等优势,有广泛应用场景。
告别死记硬背!SkillRL自动提炼Skills持续进化
大型语言模型智能体常孤立运行,难从经验学习。SKILLRL受人类技能启发,提出有效经验迁移需抽象。它通过经验驱动的技能蒸馏、分层技能库和递归技能进化机制,在多实验中表现出色。
RISC-V×AI生态大会暨ArchitStudio用户大会成功举办,共绘智能计算生态新图景!
12月26日,‘RISC-V×AI生态大会暨ArchitStudio用户大会’举办,DSA领域计算实验室揭牌。浦软与隼瞻科技将依托其开展研究、转化成果。会上各方共话RISC-V与AI融合机遇,还展示了ArchitStudio等产品应用。
震撼!AI物理「双修」:亥姆霍兹方程嵌进生成器,伪影当场消失
抢滩6G前夜,香港科技大学(广州)等机构发布PhyRMDM框架,将物理约束与生成模型能力融合,解决传统AI构建无线电地图预测失真问题,成果被顶会ACM MM 2025接收,代码和权重已开源。
万万没想到,这家央企竟让香农和图灵又“握了一次手”
中国电信人工智能研究院研发布局的智传网(AI Flow),让信息技术和通信技术融合。在WAIC中,李学龙提出智传网三律,即信容律、同源律和集成律,打破传递智能的‘壁’,为数字世界带来深远影响。
如何判断AI视频真假?综述动态、可溯源、可解释的检测体系 | ACL26
AI视频生成技术发展快,现有检测方法难满足需求。新综述提出‘事实保真度验证’目标,梳理四层检测框架,涵盖底层线索、时空一致性等,强调多层证据耦合与可解释性,还分析评测指标与数据集。
一次性应用出现,个人独角兽崛起:顶级布道师Jeff Barr论AI如何重塑开发者生态|InfoQ独家采访Jeff Barr
InfoQ 独家采访亚马逊云科技核心奠基人 Jeff Barr,探讨 AI 对开发者生态的变革。他认为 AI 是能力放大器,将催生一次性应用和个人独角兽,开发者角色转变,沟通和数据更重要,还介绍了应对建议及 Kiro 挑战活动。
71.2%的惊人解决率,伦敦大学开源顶级AI代码修复智能体系统
伦敦大学等发布Prometheus AI系统,它将代码库变成知识图谱,解决9种编程语言的GitHub问题。由五个智能体协作,解决率高、成本低且已开源,或为AI编程新方向。