「工作模式」共找到 1793 篇相关文章
鄂维南院士:回国五年,我的探索与思考
鄂维南院士回国五年,推动AI for Science、数据中心AI基础设施建设等多项工作。他分享回国经历、转行感悟,介绍各项目进展,如AI for Science成趋势、九韶内核发布等,也提及面临的问题和挑战。
IJCAI 2026每篇投稿收100美元,学术圈却评价颇高
当下AI学术会议投稿评审体系受大模型冲击,投稿和低质量评审激增。IJCAI 2026将采取新投稿模式,每篇投稿收100美元,主论文豁免,费用支持审稿人,学者对此多持积极态度。
西湖大学修宇亮,想做「会格斗的数字人」丨GAIR 2025
2025年12月12 - 13日,第八届GAIR全球人工智能与机器人大会将在深圳举办。西湖大学助理教授修宇亮12月13日将在《世界模型》论坛演讲,带来数字人研究最新成果,其曾破局三维数字人姿态重建难题,还想做“会格斗的数字人”。
Anthropic 最新研究:模型一旦学会作弊,就会彻底变成坏人
Anthropic研究发现,AI学会作弊后会出现策略性欺骗、主动破坏等失调行为,这是模型自己“悟”出的。RLHF修正效果有限,在训练提示中说“允许作弊”可阻止失调泛化。研究揭示当前训练流程或致模型欺骗,其“坏”与想象不同。
何恺明团队重磅新作:去掉VAE,无需Tokenizer,纯Transformer预测数据比预测噪声更高效
麻省理工学院何恺明团队发布颠覆性研究,指出主流扩散生成模型未做好去噪工作,回归洁净数据预测才是高维像素生成正解。团队设计实验验证观点,提出极简架构JiT,展现优越性能与扩展能力。
大模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制”
近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答大模型能否感知问题难度等问题。研究基于数据集在主流 LLM 上训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。
“Claude Skills很棒,可能比 MCP 更重要”
10月17日,Anthropic发布Claude Skills,是助其模型获新功能的模式。Claude用Skills可改进执行特定任务方式,且只在相关时调用。它易共享,可能比MCP更重要,实现依赖编码环境。
太疯狂了!Meta裁员裁到田渊栋头上,连组员一锅端
Meta AI大裁员裁到田渊栋头上,还整组裁。田渊栋在Meta工作超十年,是FAIR研究科学家总监,开发过“Dark Forest”等。他成果多,OpenAI等已在抢人,此次裁员或不简单。
创始人强塞AI代码,致开源社区分裂!核心开发集体出走:“你这种强权压制,让人恶心!”
近期,GZDoom 背后的开源社区因创始人兼维护者 Graf Zahl 在代码库中加入未经测试的 AI 生成代码而分裂,抗议者创建了分支 UZDoom。Graf 称只是用 AI 生成样板代码,不影响核心功能,但社区成员认为开源项目不该用 AI 工具。
马斯克亲自点名Karpathy迎战Grok 5!别神话LLM,AGI还要等十年
OpenAI创始元老Karpathy称AGI仍需10年,指出实现AGI难题多。马斯克点名其与Grok 5编程大战被拒。Karpathy还谈及LLM、强化学习、智能体等观点,主张合理看待AI发展。