「后训练课程」共找到 3813 篇相关文章
HumanSense:探索多模态推理边界,打造「察言观色会共情」的全模态交互伙伴
蚂蚁集团与西安交通大学联合提出并开源 HumanSense,含评估基准与推理模型。通过细粒度评测、全模态消融等研究,提出优化策略,项目已在 GitHub 和 HuggingFace 开源,推动 AI 交互体验革新。
GPT-5 核心成员详解 RL:Pre-training 只有和 RL 结合才能走向 AGI
本文编译 OpenAI 研究副总裁 Jerry Tworek 访谈,探讨 RL 与通向 AGI 路径。他认为 pre - training 与 RL 需结合,GPT - 5 是 o3 迭代,还谈及推理、模型发展、训练方式及 OpenAI 研究情况等。
濒死3次,医生判他死刑!宾大教授奇迹自救,誓用AI攻克14000种绝症
宾大教授David Fajgenbaum多次濒死自救成功,创立Every Cure,借助AI系统MATRIX在7500万种药病组合中找治疗方案,已帮多名患者,还计划公开预测结果,用AI+人类模式助力医学。
刚刚,Meta风雨飘摇中发了篇重量级论文,作者几乎全是华人
风雨飘摇的Meta发布重量级论文《Agent Learning via Early Experience》,提出「早期经验」新范式,让AI智能体「无师自通」,为突破强化学习瓶颈提供新思路。该范式结合两种策略,实验效果显著,还指出了局限与未来方向。
陶哲轩亲测!GPT-5 Pro 40分钟破解3年难题,登顶最难数学考试
数学家陶哲轩将几何难题交给GPT - 5 Pro,虽推理完美但无解。同一周,GPT - 5 Pro在FrontierMath测试集夺冠。陶哲轩测试发现AI在科研不同层面表现有别,也揭示了AI理解力受限及人类与AI的分工边界。
玻璃封装大热,TGV还有多少难题待解?
先进封装成后摩尔时代芯片算力提升关键,玻璃基板封装受关注,但仍处验证阶段。TGV技术成熟度是玻璃基板技术破局点,国内部分企业有突破,不过玻璃材料物理特性制约其普及。
对抗协作+原型学习!深北莫FedPall开源,联邦学习破局特征漂移,准确率登顶SOTA
深圳北理莫斯科大学人工智能研究院在ICCV发表FedPall算法,结合原型对比与对抗协作学习,在多种特征偏移数据集获SOTA性能。该算法通过多步骤训练缓解特征漂移,在多个公开数据集表现出色。
从「对口型」到「会表演」,刚进化的可灵AI数字人,技术公开了
快手可灵团队让数字人从「对口型」进化到「会表演」,全新数字人功能在可灵平台公测。技术报告Kling - Avatar解析背后技术路径,设计多模态两阶段生成框架,实验显示其在多方面领先竞品。
从 AI 3D生成转型AI原生影视公司,Utopai Studios想「稍微」改造下好莱坞
2022年创立的AI 3D生成公司Cybever转型为Utopai Studios,获好莱坞人士投资,还推出两部AI影片计划。其00后掌舵者Cecilia Shen称要变革制作范式,解决AI视频模型瓶颈,解放创作者。
从数据分布视角,重新认识下CoT
本文从数据分布视角重新审视大语言模型的思维链(CoT)推理。指出CoT并非真正推理,而是模仿,其效果受训练与测试分布差异影响。通过实验揭示CoT在分布偏移时性能退化,提醒勿过度依赖。