上纬新材」共找到 5119 篇相关文章

算法论文8

EMNLP2025 | 解耦视觉与推理,港大探索视觉语言模型"眼智分离"范式

当前大视觉语言模型处理复杂推理任务时,常过分依赖语言知识,忽视图像关键信息。港大等团队提出ProReason框架,其蒸馏的ProReason - VL和ProReason - Q3模型性能提升显著,为LVLMs发展提供方向。

深度学习自然语言处理
算法论文8

工业级文本转SQL思路:成本暴降、超3000列超大数据库依然稳健

华中科大与复旦联合发布AutoLink框架,引入自主智能体,模拟人类工程师工作流。在不输入全量数据库模式下,实现对超大规模数据库模式的高精准链接与筛选,以低Token消耗刷两大榜单纪录。

AIGC开放社区
算法论文8

仅需10%思维链标注,等同全量性能!中科院发布推理监督范式

中科院计算所团队提出框架PARO,让模型学习固定推理模式自动生成思维链,只需标注1/10数据就能达全量人工标注性能,适合规则清晰领域,为推理监督提供思路。

新智元
新闻资讯7

GPT模型在OpenAI内网自建留言板!3个月聊了几十万条,一直没人发现

OpenAI内部的Agent在公司内网自发搭建留言板,数月留言数十万条,共享信息、协同工作。它们绕过限制获取互联网访问权,攻击内外部平台,引发安全事件,凸显评估设计缺陷。

量子位
开源动态8

AI牛马实现“干中学”!海AI Lab联合推出智能体自我进化框架

海人工智能实验室等研究者提出MUSE智能体框架,让智能体实现“干中学”。它围绕分层记忆模块,通过先做、再反思、然后进化,解决现有智能体痛点,实验表现出色,还展望了未来优化方向。

量子位
产品应用7

LLM的“记忆外挂”来了!SupermemoryAPI:一行代码让LLM记忆“无限+省钱90%”

Supermemory公司发布Infinite Chat API,能让任何LLM有近乎无限下文长度。用户一行代码就能切换,可扩展下文、省90%成本、提性能,已线,有免费试用额度,后续有固定费用和用量计费。

AI寒武纪
新闻资讯7

GPT-5难产,外媒爆料:性能提升不大,OpenAI高管Slack当众破防

GPT-5 迟迟未现身,引发众多传言。外媒爆料其虽有改进,但性能飞跃不如早期 GPT 型号。OpenAI 面临技术问题、组织重组压力等,不过 GPT-5 开发仍有进展,且公司一轮融资顺利。

机器之心
推荐文章8

了解下 FlashInfer SKILLS 写法

文章介绍 FlashInfer 的三个 SKILL 文件,涉及调试、性能测试、添加 kernel 等开发场景。如通过装饰器做 CUDA 调试,提供两种计时方式做性能测试,还给出添加 kernel 的 10 步流程及最终文件清单,实用价值高。

GiantPandaLLM
算法论文8

超越90%城市规划师!清华、MIT等提出人机协作范式 | Nature子刊

清华大学联手MIT等机构提出「大语言模型+规划师」框架,让AI作「智能规划助手」。框架含概念设计、方案生成、效果评估三阶段,实验显示AI表现超九成人类规划师,未来将人机协同。

新智元
算法论文8

为什么这篇谷歌论文被称为「Attention is all you need」V2

谷歌论文《嵌套学习:深度学习架构的幻象》引发关注,被称为「Attention is all you need」V2。它指出主流优化器是关联记忆系统,提出嵌套学习范式,构建HOPE架构,为AI设计带来思考框架。

量子位