「学习能力」共找到 4282 篇相关文章
Sam Altman提醒创业者:ChatGPT将来要做的,大家就绕开吧
在Y Combinator举办的AI Startup School活动采访中,OpenAI CEO Sam Altman复盘创业历程,分享对AI未来的看法,包括从问答工具到智能体的进化、对软件和机器人行业的影响,还为创业者给出战术建议。
软件正在发生根本变化:Andrej Karpathy 旧金山 AI创业学院演讲万字实录
Andrej Karpathy在旧金山Y Combinator AI创业学院演讲,指出软件正进入“软件3.0”时代,大语言模型(LLM)是新型计算机,能用英语编程。他探讨了LLM特性、生态,以及如何利用其构建部分自治产品等。
通义实验室最新成果WebDancer:开启自主智能Deep Research的新时代
通义实验室推出 WebDancer,解决自主信息检索智能体构建难题。它创新合成训练数据,采用两阶段训练策略应对开放网络训练挑战,在多个基准测试中表现卓越,未来还将拓展能力。
AI 创业者的反思:那些被忽略的「快」与「长」
周喆吾分享在 3D AR 社交平台 Presence 的创业反思,强调 AI 创业中‘快’和‘长 context’的重要性,还举例说明 AI 对白领工作的影响、Workflow Capture 做法等,指出产品经理和投资人应提升对模型的认知。
华为创造AI算力新纪录:万卡集群训练98%可用度,秒级恢复、分钟诊断
大模型落地需强大算力集群支撑,构建万卡级算力集群是顶尖挑战。华为昇腾万卡算力集群近乎‘永不罢工’,其公开技术秘密,提出‘3+3’双维度技术体系,多项指标表现优异。
阿里+清华发现80/20法则:LLM只靠20%的token就能学会Reasoning
阿里与清华研究发现,训练大语言模型(LLM)推理时,真正关键的是20%的高熵token,其余80%低熵token几乎无用。仅用20%高熵token做强化学习,效果超全量训练,还提出RLVR训练策略提升效率。
Claude 4如何思考?资深研究员回应:RLHF范式已过,RLVR已在编程/数学得到验证
Anthropic两位研究员在博客采访中透露Claude 4思考细节。提到可验证奖励强化学习RLVR在编程和数学领域获证明,探讨了RL扩展、模型自我意识等,还为大学生给出AI领域建议。
纯靠“脑补”图像,大模型推理准确率狂飙80%丨剑桥谷歌新研究
剑桥、伦敦大学学院和谷歌团队推出基于强化学习的视觉规划(VPRL)新范式,纯靠图像推理。新框架利用GRPO后训练,准确率达80%,超文本推理至少40%,代码已开源。
AI大厦需要新的地基!
文章指出Scaling Law面临挑战,数据对AI愈发重要,数据库正从存储介质向AI运行的地基进化。OceanBase提出构建Data×AI能力,正从一体化数据库向一体化数据底座演进,全力拥抱AI。
1/8成本比肩Claude 3.7,Mistral Medium 3来了
“欧洲OpenAI”Mistral AI发布多模态新模型Mistral Medium 3,主打编程和多模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。