悟能平台」共找到 6006 篇相关文章

算法论文7

无需外部数据!AI自问自答实现推理力进化

卡内基梅隆大学团队提出SQLM框架,这是无需外部数据的自我提问模型,含提问者和解答者角色。通过强化学习最大化期望奖励,设计自监督奖励函数。实验显示其提升Qwen2.5 - 3B - Instruct多任务准确率。

量子位
算法论文7

Meta最新大模型RL微调:在线DPO/GRPO显著优于离线DPO

Meta和NYU研究强化学习在大模型微调中的有效性,对比离线、半在线和在线训练范式。半在线和在线显著优于离线,多任务结合可验证与不可验证任务提升性,还给出不同任务的测试数据。

PaperAgent
新闻资讯7

这些关于研发提效的深度实践分享,值得每一位开发者关注 | AICon

6月27 - 28日AICon北京站上,多位大厂技术大牛将分享“AI赋研发提效”经验。如丁宇介绍AI编程范式革新,张乐分享腾讯代码智化实践,还有同程、百度、网易游戏相关人员分享研发提效经验。

AI前线
新闻资讯8

真机RL!最强VLA模型π*0.6来了,机器人在办公室开起咖啡厅

美国具身智创业公司PI发布最新机器人基础模型π*0.6,新方法大幅提升具身智成功率与处理效率。其开发的Recap方法从经验数据获训练信号,使模型执行多项真实世界应用。

机器之心
产品应用8

连肝12小时!一轮狂刷1500篇论文,写4.2万行代码,AI科学家卷疯科研圈

Kosmos是一款全程无需人类插手的AI科学家,最长连续工作12小时,平均一次研究读1500篇论文、写4.2万行分析代码,79%研究结果可被人类复现,已在多领域有7个真发现。

量子位
新闻资讯7

世纪反转:“安卓爹”谷歌成 iPhone“大脑供应商”?曝苹果每年掏70亿换定制Gemini,明年上线新Siri

彭博社报道苹果将与谷歌合作,每年付约10亿美元获定制Gemini用于升级Siri,计划明年春季推出。谷歌模型参数远超苹果现有模型,让Siri功更强大,且运行在苹果私有云。

AI前线
产品应用7

从需求到研发全自动:如何基于Multi-Agent架构打造AI前端工程师

本文介绍蚂蚁消金前端团队打造的Multi - Agent智平台“天工万象”。阐述其技术实践,对比多Agent与统一型Agent、ReAct范式与固定工作流优劣,还介绍专业智体建设,分享开发中的思考与经验。

阿里云开发者
新闻资讯8

AI下半场的「Game Changer」,直让老外惊呼「Amazing」

海外社交媒体热议中国电信的智传网(AI Flow)技术,它是人工智与通信网络交叉领域关键技术,可实现智传递和涌现。该技术由李学龙教授团队打造,其报告受关注,破AI普及困局。

机器之心
算法论文8

模拟大脑功分化!北大与港中文发布Fast-in-Slow VLA,让“快行动”和“慢推理”统一协作

北大与港中文研究团队发布 Fast-in-Slow(FiS-VLA)全新双系统视觉 - 语言 - 动作模型,将快速执行模块嵌入预训练视觉 - 语言模型,实现快慢系统一体化。该模型在多平台表现优异,控制频率大幅领先。

机器之心
算法论文8

除了prompting外,不动参数,如何改变模型行为?

文章指出传统提示工程控制大模型生成行为有缺陷,提出Steering Target Atoms (STA)方法。它用稀疏自编码器分解LLM高维表示,定位“原子知识组件”精准控行为,实验效果超现有技术,还控制推理长度。

深度学习自然语言处理