大模型后训练」共找到 9543 篇相关文章

新闻资讯8

刚刚,GPT-6正式发布!OpenAI:欢迎来到AGI时代

OpenAI正式发布GPT - 6 Astra和GPT - 6 Astra Pro,宣布AGI时代开幕。该模型训练规模,能力升级显著,价格公布。基准测试成绩优异,在多方面表现突出,还展示诸多实际应用案例,已有企业开始测试。

量子位
产品应用7

从天价咨询到免费AI,夸克能改变志愿填报这门生意吗?

高考报志愿难题一直存在,天价咨询服务并非人人能享。夸克推出国内首个高考志愿模型,免费生成志愿报告。它能理解复杂规则、把握考生需求,经多阶段训练优化,还搭载高考知识库,产品体验简便。

量子位
产品应用8

8块钱跑通一次强化学习全流程,潞晨云重塑微调赛道:1名算法工程师=1支Infra团队

模型下半场,后训练特别是强化学习成核心战场。潞晨云微调SDK上线,它是国内首个全面开放、且兼容Tinker范式的Serverless微调平台,为强化学习提供低成本解法,在易用性和成本上有优势。

量子位
产品应用8

告别复杂提示词!蚂蚁新方式让AI自动理解你的个性化需求

蚂蚁通用人工智能研究中心自然语言处理实验室提出AlignXplore方法,通过强化学习让AI从用户行为归纳偏好并动态更新。该方法训练分两阶段,支持流式偏好推断,实验表现优异,是模型个性化新尝试。

量子位
算法论文7

一文解读 LLM Posting-Train技术

文章解读了语言模型训练(Post-training)技术,介绍其核心价值,从微调、强化学习、测试时拓展三方面展开,分析现有技术瓶颈,指出前沿研究方向,还给出实践指南和工具链推荐。

海边的拾遗者
新闻资讯8

谷歌Nature震撼发文,Gemini教练暴打专家!医学双料冠军,秒出睡眠报告

谷歌DeepMind把Gemini版模型PH - LLM调教成「AI健康私教」,将可穿戴设备数据转化为睡眠健身建议,准确率超人类医生。它经两阶段训练,在多项测试中表现优异,或开启预防医学未来。

新智元
新闻资讯8

77岁Hinton首度访华,周伯文高能交锋!17分钟尖峰对话震撼全场

7月26日,77岁的AI教父Hinton首度访华,与周伯文教授进行17分钟尖峰对话。Hinton称多模态模型已有「意识」,建议分技术训练「聪明」与「善良」AI,两人还探讨AI发展路径并寄语青年科研者。

新智元
产品应用8

不上云、不租卡,如何优雅地在本地微调Qwen-VL-30B?

文章指出企业训练多模态助手,30B 参数的开源多模态模型如 Qwen-VL-30B 是不错选择,但多模态场景下显存需求。联想 ThinkStation PGX 解决了显存难题,还介绍其性能、优势、适用场景及服务等。

机器之心
算法论文8

发布学术搜索评测ScholarSearch:难倒一众DeepResearch的“开卷考试”

北京学DS - Lab发布ScholarSearch,这是评估语言模型学术检索能力的数据集,含223道高难度题目。评估显示现有模型表现欠佳,纯推理模型准确率低,有搜索功能的模型虽有提升但仍不足。

量子位
开源动态8

马斯克掀桌子了,最强开源模型诞生!Grok-2近万亿参数性能首曝

xAI官宣向所有人开源Grok - 2,其有9050亿参数、128k上下文窗口等强技术规格。还梳理了开源部分、技术特点、权限等,介绍使用方法,网友和佬高度评价,马斯克预告后续计划。

新智元