研究型智能体」共找到 5061 篇相关文章

新闻资讯8

黄仁勋:芯片公司的时代已经结束了,现在是 AI 工厂的时代

Lex Fridman 采访黄仁勋,黄仁勋谈对 AI 行业理解,认为 AI 是工业产品,NVIDIA 像建 AI 工厂。还提及算力是智能扩展关键,计算从检索转向生成,Token 细分市场,以及公司组织、架构、开源等多方面观点。

Founder Park
算法论文8

告别微调!斯坦福提出Agentic上下文工程

当前微调大语言模成本高、不灵活,‘上下文适应’方法有短板。斯坦福大学等提出ACE框架,将上下文变为动态‘战术手册’,解决现有问题。论文通过实验验证其在性能、成本和效率上优势,为大模发展指明新方向。

深度学习自然语言处理
算法论文8

具身VLA后训练:TeleAI提出潜空间引导的VLA跨本体泛化方法

现有VLA基座模能力不足,跨本体适配存在挑战。中国电信人工智能研究院具身智能团队提出“对齐 - 引导 - 泛化”(ATE)框架,实现从调架构到调分布的范式转移,适配主流VLA模,减少数据需求。

机器之心
算法论文7

震撼实锤!清华姚班校友揭「1.4×加速」陷阱:AI优化器为何名不符实?

为降低大模预训练成本,近年新优化器频出,宣称加速1.4×到2×却难落地。斯坦福研究指出方法学缺陷,对比不同缩放范式加速差异,给出优化器设计见解,证实严格基准评测必要。

新智元
算法论文8

通用LLM压缩算法,居然藏视频编码里!2.5bit实现4bit性能,硬件无缝支持

LLM.265研究发现,视频编码器是高效的大模张量编码器,现成视频编解码硬件压缩AI模数据效率高。它灵活控制码率、可压缩多种张量,还能利用GPU硬件加速。实验显示其压缩效果显著。

新智元
算法论文8

如何将LLM的"思考习惯"迁移到视觉领域?

传统多模态模处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。

深度学习自然语言处理
新闻资讯8

YC AI 创业营 Day 2:纳德拉、吴恩达、Cursor CEO 都来了

YC AI创业营第二天,微软CEO纳德拉、吴恩达等七位重磅嘉宾围绕AI技术、创业等话题分享观点,如不要将AI拟人化,智能体将成新一代计算机等,还给出产品开发、创业等方面建议。

Founder Park
新闻资讯7

独家 | 华为天才少年楼燚航离职创业,要做 200B 以上的「具身大脑」

前华为“天才少年”楼燚航离职创立引力蓝移,定位构建具身大脑。其采用分层架构,认为具身智能Scaling拐点已至,规划了数据来源和模参数规模。正与汇川合作,按24个月规划推进,面临产品验证挑战。

AI科技评论
算法论文8

因果发现大模迎来「理论破局」: DAG-FM 破解异质机制下的因果图识别与涌现难题 | GAIR Paper 116

浙大、清华与稳准智能联合发布因果发现大模DAG - FM,解决了现有模缺乏理论基础、易产生非法环路和显存爆炸问题。它在理论上证明因果图可识别,架构上避免环路,处理数据能力强,还将推进特定领域预训练。

AI科技评论
推荐文章7

从零开始玩转循环 (Getting started with loops)【译】

Claude Code团队将“循环”定义为AI智能体不断重复执行工作周期,直至满足预设停止条件。文章介绍了回合制、目标导向、基于时间和主动式四种循环类、适用场景及控制token消耗方法,还给出保证代码质量的原则。

宝玉AI