机器人训练」共找到 2902 篇相关文章

新闻资讯7

GPT之父:只用上世纪数据训AI,它居然也会写Python?!

GPT之父Alec Radford团队训练出talkie - 1930 - 13b模型,其训练数据截止1931年。该模型能说新政立法、写Python代码。团队还对比其与现代模型,发现核心能力差距不大,且用老语料调教它成聊天助手时现风格问题。

量子位
开源动态8

小红书开源大模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……

小红书hi lab团队公布首个开源大模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度大,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。

AGI Hunt
算法论文8

欲取代transformer的SSA(次平方稀疏注意力)解读

文章解读了欲取代Transformer的SSA(次平方稀疏注意力)算法。它支持12M tokens上下文,比fastAttention快52倍,训练和推理更快。SSA改变了注意力扩展特性,有计算和内存线性扩展等特性,经三阶段训练可可靠利用长上下文。

Agent的潜意识
开源动态8

蚂蚁·安诊儿医疗大模型:正式开源并登顶权威医疗榜单

近日,蚂蚁集团联合浙江省卫生健康委开源自研的蚂蚁·安诊儿医疗大模型。它基于蚂蚁百灵大模型架构,经深度训练,是参数规模最大的开源医疗模型。该模型在多评测中表现出色,有三阶段训练流程,架构高效、推理快,已开源助力行业发展。

新智元
算法论文7

让推荐学会思考:用强化学习激活大模型的序列推理能力

文章指出推荐系统曾未紧密结合大模型能力,如今正靠近其训练范式。作者基于用户行为序列,用强化学习训练大模型理解序列关系,以预测用户下一个可能点击的资讯,并通过实验验证了该方法的可行性,还探讨了不同数据库中BM25算法的差异。

AI科技评论
推荐文章8

AI大模型开发核心技术栈:从框架到部署的全景解析

本文为开发者提供2025年AI大模型开发核心技术栈图谱,解析四大核心支柱技术。基础开发框架含深度学习与AI Agent框架;模型训练与微调有分布式训练、参数高效微调;推理优化含关键技术与主流框架;AI编程辅助工具分主流形态且有发展趋势。

AIGC开放社区
产品应用7

三个理想火枪手创业,打破具身最快百台交付纪录

至简动力由理想智驾团队三位核心负责人创立,7月6日宣布首款全场景机器人i7 Pro完成首批百台交付,创下具身智能行业最快纪录。其与绿的谐波子公司合作落地全球首个CNC智能化具身机器人产线,i7 Pro还进入多场景。公司计划进入多领域,将发布新品。

量子位
开源动态8

R-HORIZON:长程推理时代来临,复旦NLP&美团LongCat重磅发布LRMs能力边界探测新范式

复旦大学与美团LongCat Team联合推出R - HORIZON,它是首个系统性评估与增强LRMs长链推理能力的方法与基准。提出Query Composition方法构建评测基准和训练数据,评测发现主流模型长链推理性能断崖式下降,还分析出三大瓶颈,训练后模型性能双重提升。

机器之心
推荐文章7

The Batch: 895 | 发起群聊的聊天机器人

如今互联网受AI泛滥化影响,还面临阻止LLM进入的情况。但AI可被设计连接人们,如在聊天中作积极联合力量。研究者做些改变就可行,未来AI或能促人类共同提升。

DeeplearningAI
新闻资讯7

The Batch: 901 | 医疗健康聊天机器人争相登台

OpenAI和Anthropic在医疗健康市场布局,OpenAI发布面向消费者的ChatGPT Health,可调取医疗信息,有安全隐私措施;Anthropic推出面向医疗专业人士的Claude for Healthcare,可加快文书处理。此前谷歌健康摘要功能因错误信息被撤。

DeeplearningAI