「亲吻数难题」共找到 1590 篇相关文章
首个地球科学智能体Earth-Agent来了,解锁地球观测数据分析新范式
上海人工智能实验室与中山大学联合研发的 Earth - Agent 解决了多模态大语言模型用于地球科学研究的痛点。它将领域知识工具封装化,利用 LLM 智能规划调度。经 Earth - Bench 评估,其在多方面表现出色,未来发展前景广阔。
推理效率狂飙60倍:DiDi-Instruct让扩散大模型16步超越千步GPT
普渡大学等研究者提出 DiDi-Instruct 后训练方法,可将扩散大语言模型推理加速 60 倍,超越传统 GPT 模型。该方法实现推理效率与效果双提升,为大语言模型落地提供新方案。
一个指令误导智能模型!北航等首创3D语义攻击框架,成功率暴涨119%
北京航空航天大学与中关村实验室团队提出全新框架InSUR,入选NeurIPS 2025。该框架可基于指令生成对抗样本,首次实现3D SemanticAE生成,从采样、建模、评估三方面突破,实验验证其有效性与可扩展性。
小扎新AI,凉得彻底?
9月25日,Meta推出嵌入Meta AI应用的AI视频流Vibes,可浏览、二创和分享AI视频,改写短视频玩法。它降低创作门槛,融入Meta生态,野心勃勃,但也带来版权等争议,还将与硬件结合,AI视频或成新全民入口。
狂涨14.4K star!大三学生开发的Github可视化利器,真吊!
开源君介绍`gitdiagram`,这是结合AI与Web开发栈的开源工具,能将GitHub仓库变成交互式架构图。由大三学生开发,获14.4k星标,微软等企业团队采用,性能佳、使用便捷。
混元3D开源端到端全景深度估计器,代码+精选全景数据已上线,在线可玩
全景深度估计在3D视觉领域日益受关注,但因全景数据稀缺、球面畸变问题,以往方法零样本泛化和效率不佳。腾讯混元3D团队提出DA²,通过数据扩充引擎和SphereViT架构,提升性能,展现SOTA表现。
没想到,32B清华DeepDive掀翻深度搜索全场的!
文章指出大模型在真实深网搜索场景表现不佳,核心矛盾是缺‘难搜’数据和多轮工具调用 RL。清华 DeepDive 用数据合成造‘难搜’题,端到端多轮 RL 训练,在 BrowseComp 刷新开源记录,迁移能力也强。
给几何图片写标题就能让AI更聪明,UIUC发布高质量可泛化几何数据集
随着多模态大语言模型在视觉问答等任务广泛应用,其几何推理能力成研究热点。现有方法泛化能力有限,UIUC团队提出Geo - Image - Textualization框架,发布GeoReasoning - 10K数据集,提升模型几何推理表现。
比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升
中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案集编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。
119 页硬核报告丨AI 2030:算力、能源与科研的未来预测
Epoch AI 受 Google DeepMind 委托编写报告,探讨 AI 规模扩张至 2030 年在计算、投资等方面的影响,认为扩张很可能持续,还会加速多领域科学研发,虽预测有不确定性,但 AI 会成关键技术。