新能安」共找到 7818 篇相关文章

算法论文8

传统RAG只会翻书不会用?RAG+让Reasoning力上一个高度!

现有检索增强生成(RAG)技术在需复杂推理领域表现不佳,像只给菜谱不给实操演示。RAG+开创性增“应用案例库”,与知识库构成双料库,在数学、法律、医疗场景测试中全面碾压传统方案,团队还透露了未来方向。

深度学习自然语言处理
算法论文8

√N并行+84倍计算加速!英伟达港大全图像注意力:空间结构都保留

英伟达、港大等研究人员提出型视觉注意力机制GSPN,通过线性扫描和稳定性 - 上下文条件处理图像空间结构,降低计算复杂度至√N量级,在多视觉任务达先进水平,生成16K图像加速超84倍。

新智元
新闻资讯7

o3-pro通关“推箱子”,人类怀旧小游戏成了大模型Benchmark

推箱子、俄罗斯方块等经典小游戏成大模型benchmark,o3 - pro挑战这两款游戏表现出色,突破benchmark上限,成绩远超o3。Lmgame含多款游戏,有不同评价方式,且开源可用于模型测试。

量子位
开源动态8

Spring AI Alibaba 1.0 GA 正式发布,Java智体开发进入时代

2025年AI智体爆发,Java智体构建需求激增。Spring AI Alibaba 1.0发布,是基于Spring AI的AI框架,提供多智体框架、生态集成等核心力,助力Java智体开发,还规划了持续迭代、可观测评估等功

阿里云开发者
算法论文8

扩散语言模型扛把子LLaDA迎来版本,数学、代码、对齐力均提升

中国人民大学与蚂蚁集团团队基于前期 8B 扩散语言模型 LLaDA,提出方差缩减的偏好优化方法 VRPO,推出 LLaDA 1.5。它在数学、代码、对齐任务上性提升,VRPO 为扩散语言模型对齐提供框架。

机器之心
开源动态8

阿里智体多轮推理超越GPT-4o,开源模型也做Deep Research

通义实验室推出自主信息检索智体WebDancer,其通过系统化训练范式为构建智体提供路径,也为在开源模型上复现Deep Research系统提供指导。它在多数据集测试中表现出色,团队还对其未来应用做了展望。

量子位
产品应用7

用DeepSeek徒手造一个对话的AI简历,助你当场拿下Offer。

作者招人时收到很多AI生成简历,有份把自己变成含AI对话的可视化简历脱颖而出。作者分享用Dify+Gemini或DeepSeek+YouWare搭AI简历方法,还以马斯克求职为例演示操作步骤。

数字生命卡兹克
产品应用7

文旅玩法!藏师傅教你做食物微缩景观宣传海报&视频

作者玩 Gpt - 4o 图片生成时,用食品做键盘图,又结合食物与城市做微缩场景海报,还用 Veo3 做微缩景观生长动画,给出各工具提示词,鼓励大家尝试。

歸藏的AI工具箱
算法论文8

大模型手语翻译进展:CAPO-SLT拿下中文三项最高分 | EMNLP'26

vivo AI Lab团队针对自动手语翻译生成中,无视觉证据支撑的错误累积导致语义偏移的痛点,提出置信度感知策略优化方法CAPO-SLT,仅调整强化学习更规则,不修改主干网络,在中文手语翻译测试中拿下三项指标最高分,成果将发表于EMNLP'26。

量子位
算法论文8

不换模型,效果提升104%!上海AI Lab让Harness也自进化了

上海人工智实验室团队提出的Self-Harness引发关注,它针对Agent外层Harness改进。实验显示,在Terminal-Bench-2.0上,不换模型只改Harness,Qwen3.5-35B-A3B等模型效果显著提升。

量子位