强化学习算法」共找到 1910 篇相关文章

推荐文章8

刚刚,翁荔博客上新:谨慎对待Scaling Law

翁荔新作《谨慎对待 Scaling Law》上线,文章涵盖 Scaling Law 预测内容、计算最优分配原理等。介绍了早期对机器学习损失可预测性的研究,还对比了 Kaplan 等人与 Chinchilla 的 Scaling Law,分析了两者分歧原因。

机器之心
算法论文8

基于LLM的Agentic Reasoning框架综述:从方面到场景的全面总结

近年来,大型语言模型虽能力强但有局限,研究者构建基于LLM的智能体系统。此综述论文提出系统、统一分类法梳理智能体推理框架,建立统一描述语言和通用算法,分析其在不同场景表现与评估方法。

深度学习自然语言处理
新闻资讯7

180亿深圳芯片黑马,华为猛下单

4月25日晚,云天励飞公告2024年营收超9亿,同比增81.3%,截至4月28日收盘市值超180亿。该公司以‘算法芯片化’为基础,在推理算力、行业赋能、消费级业务均有布局,还与华为等合作。

芯师爷
新闻资讯8

原来这届中国AI年轻人,已经卷到业界都惊了

在小红书上,一群热爱技术的年轻人搞了一场为期五个多月的腾讯广告算法大赛。赛题是全模态生成式推荐,考验选手探索精神。比赛结束后,表现突出选手将被纳入腾讯“青云计划”。

机器之心
新闻资讯7

DeepSeek 新模型曝光,即将发布

据彭博社消息,年初凭 R1 模型震动全球的 DeepSeek 正开发全新 AI Agent 模型,创始人推动团队在今年四季度发布。该模型能代表用户执行多步骤操作、基于过往行为学习改进,行业也在向 Agent 软件转型。

AGI Hunt
推荐文章8

Agent性能暴涨90%,刷榜GAIA可太容易了~

今年AI Agent层出不穷,当前研究缺乏统一标准、复现难。oppo Agent团队分享构建高效Agent的关键组件及刷榜GAIA的方法,从事实获取能力和逻辑推理保真度两维度分析,介绍了强化感知和提升思维的策略。

探索AGI
算法论文7

宇宙尺度压缩:Scaling Law的边界,柏拉图表征收敛于物质和信息交汇,解决P与NP问题,Simulation假说……

超对称公司在BigBang - Proton实现跨尺度跨结构科学多任务学习,提出宇宙尺度压缩构想。文章论证其科学基础、工程可行性与意义,探讨Scaling Law边界,还给出宇宙尺度压缩计划和相关假设。

AI科技大本营
开源动态8

本周推荐的5个yyds的Github开源项目!

本文推荐 5 个 GitHub 开源项目,有给容器提供 GUI 支持的 x11docker、AI 证件照制作工具 HivisionIDPhotos、仓库可视化工具 GitDiagram、英语学习应用 TypeWords 和自托管记账应用 ezbookkeeping,各有特色功能。

开源先锋
产品应用7

NotebookLM能生成PPT了,还带演讲配音

谷歌NotebookLM有新功能,输入数据、图表、旁白就能自动生成带AI音频的PPT,还能让AI写旁白。此功能对总结汇报、学习新知识都实用,也有人试用后反馈存在速度慢等问题。

量子位
推荐文章7

有些时候真觉得,AI总结和“三分钟看电影”没啥区别。

作者不喜欢用AI总结内容,认为它和“三分钟看电影”类似,会清除内容的细节和体验感。作者强调真正的学习和创造诞生于“无聊”时刻,呼吁人们在追求“快”的时代,享受“慢”过程,别让AI替自己生活。

数字生命卡兹克