联合自注意力」共找到 2250 篇相关文章

新闻资讯8

30人团队震撼英伟达!Jim Fan曝三个教训,重押世界模型

英伟达Jim Fan带队创立GEAR实验室,30人团队产出惊人,涵盖机器人学习完整技术栈。团队有GR00T基础模型等成果,Jim Fan还分享三个教训,重注视频世界模型,提出仿真世界三阶段,指出物理AI未来是新基础设施。

新智元
新闻资讯7

打脸哲学无用!牛津博士教出Claude,曝百万年薪提示词秘诀

Anthropic驻场哲学家Amanda Askell主导设计Claude的性格等机制,她分享制定有效AI提示词方法,认为需哲学思维。此外还提及不同人对提示词看法,以及大模型存在的「裂脑问题」。

新智元
新闻资讯7

他为500强造出冠军「AI裁员机器」!然后,把己裁掉了

Donald King在普华永道为500强客户打造AI智能体,刚获OpenAI黑客松比赛第一名,2小时后就被裁。他创业成立AI营销机构,称被裁是好事,还建议失业者扩展人际网络。

新智元
算法论文8

适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出多模式适应路由,实现模式适应切换,在多基准测试中效果与效率双升。

深度学习自然语言处理
开源动态8

AI牛马实现“干中学”!上海AI Lab联合推出智能体我进化新框架

上海人工智能实验室等研究者提出MUSE智能体框架,让智能体实现“干中学”。它围绕分层记忆模块,通过先做、再反思、然后进化,解决现有智能体痛点,实验表现出色,还展望了未来优化方向。

量子位
算法论文8

VAE时代终结?谢赛宁团队「RAE」登场,表征编码器或成DiT训练新基石

纽约大学谢赛宁团队推出RAE替代VAE,解决了DiT依赖旧版SD - VAE的问题,如架构复杂、潜空间受限等。RAE结合预训练编码器和解码器,还提出DiT^DH变体,实验效果好,网友看好其前景。

机器之心
新闻资讯8

西湖大学打造了一个AI科学家,突破人类SOTA,还能己发论文

西湖大学文本智能实验室推出能主探索的AI科学家DeepScientist,两周完成人类三年科研量。它在三个前沿AI任务刷新SOTA纪录,还能写论文。文中介绍其科研历史、工作方式、成果及面临的伦理问题。

AIGC开放社区
开源动态8

耶鲁等团队联合发布首个虚拟细胞Agent,可动设计出先进的模型

耶鲁等团队发布首个多智能体系统CellForge,可动化设计虚拟细胞模型。它能输出模型架构和代码,有跨模态能力,性能超多个领域代表性模型,可降低科研门槛,加速药物研发。

力学与人工智能
开源动态8

谷歌版小钢炮开源!0.27B大模型,4个注意力头,专为终端而生

谷歌开源Gemma 3 270M,几分钟就能完成微调,性能超Qwen 2.5同级模型。此模型小巧高效,可本地运行,还能用它构建OCR应用。它有多项亮点,适合多场景,上手简单。

量子位
7

AI越来越强大,如果客户都去研了,那企业软件市场会怎么样?

AI能力变强、门槛降低,引发企业软件开发是否会被颠覆的讨论。企业不会建核心系统,因要专注核心业务且不想承担维护等成本。真正威胁是用AI重新设计产品的同行,技术更替规律下传统SaaS公司需警惕。

AI工程化