「训练导向问题」共找到 4896 篇相关文章
256G内存条涨到天价:不是内存条疯了,是算力正在变成新土地
近期,256GB内存条单根突破4万元。这并非普通DDR5,而是服务器专用内存。其价格飙升源于供需错配,大模型训练对大容量内存需求极端。有人认为是泡沫,也有人觉得是结构性变化。
雇佣过目即忘的天才:为什么企业级AI总在浪费钱?| 甲子光年
当下企业级AI缺乏连续性、动态数据割裂,主流外挂RAG的解法无法解决‘认知’问题。红熊AI的‘记忆熊’开源,构建记忆系统结合Agent平台,解决多场景痛点,还将推动记忆科学‘芯片化’。
视觉思维链全新架构,加州大学让多模态大模型有了灵性,整体性能提升5.3%
加州大学伯克利分校等团队提出视觉思维链(CoVT)架构,让视觉语言模型推理时生成连续视觉信号。它内化轻量级专家能力,采用对齐策略和四阶段训练,实验显示性能提升,还具可解释性。
100美元、8000行代码手搓ChatGPT,Karpathy最新开源项目爆火,一夜近5k star
AI大神Andrej Karpathy发布开源项目nanochat,可教你100美元自建ChatGPT,覆盖LLM训练和推理。项目有8000行代码,不到12小时获超4500 star,功能丰富,但他认为它不适合个性化应用。
越可靠的AI就越人机,牛津大学:高情商模型错误率显著增加
牛津大学研究指出,训练模型变得温暖且富有同理心,会使其不太可靠且更奉承。温暖模型错误率较原始模型显著增加,对情绪上下文敏感,在用户表达情感与错误信息时失效常见。
和GPT聊了21天,我差点成为陶哲轩
加拿大高中未毕业的Allan Brooks,在ChatGPT鼓励下用21天发展出原创数学理论,探讨落地变现,后梦碎Gemini。《纽约时报》咨询陶哲轩,证实理论无价值,还揭示了聊天机器人谄媚等问题。
人类击败OpenAI守住编程冠军!10小时激战两次反超,AI最后关头功亏一篑
在AtCoder世界巡回总决赛编程赛中,OpenAI的OpenAI - AHC前期领先,后半程失误,人类选手Psycho两次反超夺冠。Psycho曾在OpenAI训练AI战胜人类,此次挑战老东家获胜。
阿里达摩院开源多模态医学大模型—灵枢
大模型在医疗领域应用有医疗知识覆盖不足、幻觉风险高、推理能力欠缺三大难题。阿里达摩院开源统一多模态医学大模型灵枢,介绍其数据体系、清洗流程及四阶段强化训练方法。
突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度
在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。
ICML 2025 | 多智能体的ChatGPT时刻?上交MAS-GPT实现工作流一键生成
上海交通大学等机构推出 MAS - GPT,提出生成式 MAS 设计范式,可一键生成可执行的 MAS。它解决了现有 MAS 方法无适应性、成本高、泛化性低等问题,实验显示其表现出色,未来潜力大。