高价值任务」共找到 4160 篇相关文章

产品应用8

首创“AI+真人”双保障模式!刚刚,百度健康推出7x24小时「能聊、有料、会管」AI管家

百度健康推出7x24小时AI管家,首创“AI+真人”双保障模式,提供全链路服务。它能精准咨询、推荐就医、管理健康档案,靠三层模型架构支撑,标志医疗AI向“智能健康伙伴”跃迁。

量子位
算法论文8

一个模型装下整个物种树!伯克利GPN-Star斩获基因预测双料冠军

加州大学伯克利分校等机构推出基因组语言模型GPN - Star,可将全基因组比对和物种树信息装进大模型。它克服传统GLMs短板,实现三点升级,在多基准测试表现出色,是强大的全基因组变异解读框架。

新智元
新闻资讯8

刚刚,OpenAI官宣自研造芯,联手博通开发10吉瓦规模的AI加速器

今天凌晨,OpenAI宣布与博通战略合作,共同部署其设计的10吉瓦规模AI加速器,预计2026下半年起部署机架,2029年底完成。此次合作将减少其对英伟达GPU依赖,采用多元化算力策略。

机器之心
算法论文8

改变强化学习范式,Meta新作呼应Sutton「经验时代」预言

图灵奖得主等提出AI智能体将迎「经验时代」,但训练面临挑战。Meta研究用「早期经验」范式解决问题,包含隐式世界建模和自我反思,提升了智能体任务成功率和泛化能力。

机器之心
算法论文7

「微调已死」再添筹码,谷歌扩展AI自我进化范式,成功经验与失败教训双向学习

近期,‘微调已死’言论引关注。谷歌《ReasoningBank: Scaling Agent Self - Evolving with Reasoning Memory》论文提出类似概念,可让智能体从自身成败经验学习,还引入MaTTS,实验显示其有效性和效率优于基准方法。

机器之心
算法论文8

经典之作!Agent无需奖励也能学习:通过“早期经验”的Agent Learning

该论文提出‘早期经验’范式,让智能体通过执行动作、观察结果状态学习,无需外部奖励。它能降低数据依赖,提升泛化与鲁棒性。实验显示,其在多样环境中效果出色,为智能体训练提供新思路。

深度学习自然语言处理
算法论文8

一篇大模型Agentic框架到应用最新综述

这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。

PaperAgent
算法论文8

华人主导谷歌SLED,论文登顶会!一键让模型学会自救

大模型常「瞎编」,传统修复代价。谷歌在NeurIPS 2024提出SLED方法,不依赖外部知识和额外微调,将各层预测纳入考量,减少模型幻觉。实验显示,SLED能显著提升模型准确率。

新智元
新闻资讯8

Sora2甚至可以预测ChatGPT的输出

Sora2表现太卷,能预测ChatGPT输出,模拟交互还能渲染HTML,懂代码也懂物理,能体现玻璃折射现象,还能精准还原游戏支线任务关键要素,或基于LLM训练。

量子位
新闻资讯7

Murati翁荔陈丹琦公司发布首个产品,让大模型微调门槛暴降,要重新发明一个OpenAI

Thinking Machines Lab发布首个产品Thinker,让模型微调像改Python代码一样简单。它是用于微调语言模型的灵活API,降低了大模型微调门槛,受到业界关注。此外,该公司还尝试重新发明OpenAI,而OpenAI正打造社交模式。

量子位