注意力去偏」共找到 443 篇相关文章

新闻资讯8

津渡生科邓司伟:「AI+生物制造」到底是什么?全链智能已经实现

当前生物制造迈向大规模工业化,AI深度介入。津渡生科邓司伟在大会指出,应构建全链路智能闭环,将AI渗透到发现、验证、生产三阶段,重塑工艺边界,实现专业经验中心化。

AI科技评论
新闻资讯8

氛围编程后,Karpathy又双叒有新「脑洞」!PDF将死,未来99%是AI氛围阅读

Karpathy提出未来研究论文不应是PDF格式,未来99%注意力将来自AI,科研成果应为AI优化。此观点源于生物学家Michael Levin关于为AI写作的讨论,引发众多科技思想者回应。

新智元
新闻资讯7

刚刚,Ilya Sutskever宣布自任CEO:联创被Meta挖走了

周五凌晨,OpenAI 联合创始人 Ilya Sutskever 宣布自任 Safe Superintelligence(SSI)首席执行官,原 CEO Daniel Gross 已退出。此前有 Meta 欲收购 SSI 的传闻,Gross 或转 Meta 负责人工智能产品。

机器之心
算法论文8

首次!世界模型、动作模型融合,全自回归模型WorldVLA来了

阿里巴巴达摩院提出全自回归模型 WorldVLA,首次融合世界模型与动作模型,统一文本、图片、动作理解和生成。它用独立编码器处理多模态数据,还提出策略解决误差累积问题,实验表现优异。

机器之心
新闻资讯8

马斯克公布SpaceX火星新计划,迈向多行星生命之路!

马斯克在德州Starbase公布SpaceX火星最新计划,介绍从Starbase发展、星舰生产目标、技术突破到火星城市建设等多方面内容,展示人类成多行星物种的清晰路线,还提及火星时间表等信息。

AGI Hunt
算法论文7

模型宣称的“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相

近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难的原因及面临的瓶颈。

深度学习自然语言处理
新闻资讯7

扒开1604份招聘,DeepSeek们最狠的大招藏在招人里

Epoch AI调查6家中国AI公司1604个岗位,发现中国AI公司用人不重资历重能力,岗位集中在北京、杭州、上海,不同公司有不同业务侧重和发展方向,招聘启事暴露其战略布局。

新智元
推荐文章8

linux.do:一个被严重低估的中文技术社区,国内懂的人都在偷偷用

本文介绍了中文技术社区 linux.do,它上线两年多,虽访问量已追上老牌社区 V2EX,但很多人不知其存在。其核心围绕 ChatGPT 和大模型,有一手信息、开源协作氛围和活跃管理团队,还给出注册及避坑建议。

AI Reading Hub
新闻资讯8

AI教父Hinton首爆十年前拍卖:我早已内定谷歌必赢!

NeurIPS 2025访谈中,AI教父Hinton和Jeff Dean回顾AI发展。Hinton透露Scaling顿悟源于Ilya演讲,还谈及AlexNet、谷歌大脑诞生等。二人探讨Transformer、Gemini,也对AI未来发展方向发表看法。

新智元
开源动态8

20000 GPU·h砸出 106 个SOTA模型架构:AI 科研进入“自我加速”时代

模型架构发现领域迎来突破,ASI - ARCH超级智能体无需人类预设搜索空间,完成科研闭环。经20000 GPU·h、1773次实验,发现106个超越人类SOTA的线性注意力架构,且已开源。

PaperAgent