「95后团队」共找到 5013 篇相关文章
告别纯奖励试错!二次尝试+反思蒸馏,复杂任务提升81%
美国南加州大学和宾夕法尼亚大学团队提出新训练范式ERL,将「经验学习」引入强化学习,通过二次尝试和反思蒸馏,在复杂任务中性能显著提升,为构建长期自主智能体提供新思路。
十三年布局,一朝反超!谷歌AI崛起的真实故事
2025年谷歌多款AI成果表现亮眼,如Nano Banana登顶、Gemini App下载量第一、Gemini 3超ChatGPT。这场逆袭始于2012年太浩湖竞拍,之后谷歌收购DeepMind、发明Transformer、自研TPU芯片,虽历经波折,终在2025年反超。
深度之赌:从卧室到上帝机器
文章讲述现代AI秘史,从Jeff Dean本科研究神经网络失误,到Google Brain诞生;还有Hinton等深度学习先驱经历,如Hinton当实习生、AlexNet诞生等,也提及Google发展及未先发ChatGPT原因。
谢赛宁REPA得到大幅改进,只需不到4行代码
Adobe Research等团队对REPA展开研究,发现驱动目标表征生成性能的是空间结构而非全局性能。基于此构建iREPA,代码不到4行,能提升REPA收敛速度,在多方面表现出色。
NeurIPS 2025|VFMTok: Visual Foundation Models驱动的Tokenizer时代来临
传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。
LangChain提出Agent工程化的新分层(Agent harness)
LangChain获新融资后重新定位为Agent基础设施提供商,将Agent开发分三层:Framework、Runtime、Harness。Vtrivedy提出Agent Harness概念,强调构建关键是“个性化定制基座”。Agent开发工程化成熟度在提升。
DeepSeek 新模型 R1-0528 悄悄开源,与o3 相当,实测来了。
DeepSeek团队悄无声息地在Hugging Face上开源推理模型新升级版DeepSeek R1-0528,基于DeepSeek-V3-0324模型,架构和训练方法有改进,性能与o3相当,实测表现不错。
挑战扩散自回归统治!字节提出视觉生成第三种路线,让模型像人类一样边画边改
五一期间字节商业化技术团队研发出新一代视觉生成模型,其底层架构是全新的第三条路——生成精炼网络GRN。它能让AI像人一样边画边改,解决了现有模型的问题,在多项基准测试中刷新SOTA记录。
MASFactory: 多智能体系统开发进入Vibe Graphing时代
AI能力迭代,多智能体编排却停留在旧阶段。北京邮电大学GAMMA Lab团队发布MASFactory,用Vibe Graphing编排多智能体系统,融合多种开发方式,有全栈可视化等优势,还给出实用案例和开源代码。
字节Seed发布PXDesign:蛋白设计效率提升十倍,进入实用新阶段
字节跳动Seed团队提出可扩展蛋白设计方法PXDesign,24小时生成数百高质量候选蛋白,效率较主流方法提升约10倍,湿实验成功率达20%–73%。还推出公开免费在线服务,提供配套工具加速应用落地。