亿嘉和」共找到 6947 篇相关文章

推荐文章8

从RLHF、PPO到GRPO再训练推理模型,这是你需要的强化学习入门指南

强化学习是当今LLM重要技术,Unsloth团队发布教程,从吃豆人谈起,介绍RLHF、PPO到GRPO,分享用GRPO训练推理模型技巧,涵盖相关概念、训练方法及奖励函数设计等内容。

机器之心
算法论文8

一篇95页最新80种Deep Research系统全面综述

浙大研究深度研究系统领域,分析自2023年以来80多个相关实现,提出4维度分层分类法,全面分析4种实现架构,还阐述各维度演变进步。

PaperAgent
新闻资讯7

1分钟烧掉165万元!马斯克死磕OpenAI,300亿新融资豪赌AGI

xAI每月烧钱10亿美元,正进行43亿美元股权融资,计划明年再筹64亿,还有50亿债务融资。马斯克有三张王牌,xAI预计2027年盈利,其目标是创造AGI,这场豪赌结果待时间揭晓。

新智元
产品应用8

松下发布多模态大模型,文本、图像、音频随意切换

多模态数据处理成热点,但现有模型处理复杂任务有挑战。松下开发多模态大模型OmniFlow,采用模块化设计、多模态引导机制,实验显示其在多任务中有卓越表现。

AIGC开放社区
推荐文章7

游戏教父 John Carmack:LLM 不是游戏的未来

游戏教父 John Carmack 认为 LLM 不是游戏未来,强调交互式体验学习重要性。他倾向游戏虚拟环境研究,分析 Atari 游戏强化学习问题,还提及离线学习、迁移学习等方面挑战。

AI前线
新闻资讯7

AI进化三年,产业落地真拐点可能就在这场全球顶尖金融智能赛事里

AI发展三年走到关键转向点,应用价值成关键。金融行业是AI应用复杂领域,AFAC2025金融智能创新大赛聚焦解决产业真问题,设百万奖金池,开放多赛道赛题,已开启报名。

机器之心
产品应用7

从天价咨询到免费AI,夸克能改变志愿填报这门生意吗?

高考报志愿难题一直存在,天价咨询服务并非人人能享。夸克推出国内首个高考志愿大模型,免费生成志愿报告。它能理解复杂规则、把握考生需求,经多阶段训练优化,还搭载高考知识库,产品体验简便。

量子位
算法论文8

CVPR 2025 Highlight|北大联手智元发布首个基于说明书的家电操作评测基准

北大联合智元团队提出全新家电操作评测基准 CheckManual,被 CVPR 2025 接收并评为 Highlight。它有拟真说明书与多样资产、契合实际的评测任务、首个操作规划模型 ManualPlan 等优势,还做了相关实验。

机器之心
推荐文章7

240 款 AI 软件定价分析:从席位到成果,AI 定价的五种趋势

国外科技作者 Kyle Poyar 收集超 240 家软件公司数据,分析 AI 软件定价。指出传统定价面临挑战,混合定价成主流,还介绍常见策略、结果定价问题、价格透明化困境及企业准备不足等情况。

Founder Park
算法论文8

何恺明新作:给扩散模型加正则化,无需预训练无需数据增强,超简单实现性能提升

何恺明最新论文研究扩散模型与表征学习的联系,提出Dispersive Loss正则化方法。它无需正样本对,有高通用性、低计算开销等优势,在多模型测试中提升了生成质量,在其他任务也有潜力。

量子位