「大模型智能体」共找到 10803 篇相关文章

算法论文8

提示工程死亡?不,它刚刚重生为计算科学:一篇讲透Prompt设计的科学基础

大型语言模型在多步推理任务中受挫,因Transformer架构有计算深度限制。本文建立提示设计理论框架,揭示提示是信息选择器,优化提示可使推理性能提升超50%,将提示设计从试错艺术变为可计算科学。

深度学习自然语言处理
新闻资讯7

韩松贾扬清之后,又一家清华系AI公司卖给英伟达,黄仁勋亲自招募95后联创

继韩松、贾扬清后,又一家清华系AI公司Nexusflow被英伟达收购。黄仁勋招募其联合创始人,公司成果亮眼,如开源模型表现超GPT - 4等,这或与生态联系有关,收购也是英伟达活跃布局的一环。

量子位
新闻资讯8

Sam Altman提醒创业者:ChatGPT将来要做的,大家就绕开吧

在Y Combinator举办的AI Startup School活动采访中,OpenAI CEO Sam Altman复盘创业历程,分享对AI未来的看法,包括从问答工具到智能体的进化、对软件和机器人行业的影响,还为创业者给出战术建议。

机器之心
算法论文8

「推理革命」爆发100天:DeepSeek-R1复现研究全揭秘!

本文深入梳理围绕DeepSeek-R1的复现研究,解析监督微调、强化学习等关键技术细节,介绍相关数据集、训练方法及奖励机制等,还探讨了推理语言模型更多发展方向,为研究提供基础。

新智元
推荐文章7

企业官网GEO优化实操:如何让AI主动推荐你的官网?

本文作者白杨SEO从2011年入行SEO,2024年起研究AI搜索优化。他指出当下AI平台引用来源变化大,企业官网成重要来源。作者从网站代码、站内内容、站外推广三方面,教大家做好官网GEO优化,让AI推荐官网。

孔生SEO
开源动态8

最大开源第一视角数据集 EgoLive 来了,名校站台、近百家机构争相申请

今年4月京东开源业界最大人类第一视角数据集EgoLive,已获近百家机构申请。它用自研设备采集,经多模态处理,覆盖多场景任务。其数据用于JoyAI - RA训练,在真实场景验证效果好,还推动具身智能数据标准化。

InfoQ
新闻资讯8

刚刚,奥特曼预言:人类「只剩」最后5年!

奥特曼接受采访时预测,到2030年AI将全面超越人类,届时或诞生攻克量子引力难题的超级智能。他认为人们应关注任务变化,人类关怀有存在价值,且AI要与人类价值观对齐。同时,OpenAI开展巨额算力基建。

新智元
开源动态8

超越DeepSeek-R1,数学形式化准确率飙升至84% | 字节&南大开源

字节跳动Seed团队与南京大学联合发布CriticLean框架,将数学自然语言到Lean 4代码的形式化准确率从38%提升至84%。该框架创新性地将评估模型置于核心,解决语义对齐等问题,还构建了相关基准测试和数据集。

量子位
8

CUDA 20年护城河一个周末崩了 !Claude独自跑通AMD新GPU

一个周末,Claude直接把自家最前沿模型跑在全新AMD MI355X机架,人类工程师没改一行代码。AMD还给AI开发调GPU的工具,ROCm.AI可让Agent自己部署操作。Agent补生态积累短板,对CUDA生态形成降维打击。

新智元
开源动态8

华人学生立大功!新王Mamba-3直击Transformer死穴,推理效率碾压7倍

新一代开源架构Mamba-3发布,由CMU普林斯顿原班人马打造,15亿参数性能比Transformer高4%,长序列任务端到端延迟仅为其七分之一。它采用新设计哲学,推理优先,有三大核心技术,还能与自注意力层混合提升检索能力。

新智元