与爱为舞」共找到 9233 篇相关文章

算法论文8

Qwen&清华团队颠覆常识:大模型强化学习仅用20%关键token,比用全部token训练还好

Qwen清华LeapLab团队研究发现,大模型强化学习训练推理能力时,仅20%高熵token就能撑起效果,甚至超全部token训练。团队用此在Qwen3-32B创造新SOTA记录,还探讨了强化学习的相关特性。

量子位
新闻资讯7

吴恩达来信:AI Dev 26即将举办!

吴恩达来信称 4 月 28 - 29 日将在旧金山举办 AI Developer Conference,主题‘软件工程的未来’。他认 AI‘就业末日’没那么严重,软件工程岗位在增长,还指出编程变化及行业待解问题。

DeeplearningAI
算法论文8

Nature子刊:太空中建数据中心,无限能源,浙大首次证实可行!

浙江大学和新加坡南洋理工大学新研究探索太空碳中和数据中心可行性。太空有太阳能散热优势,提出轨道边缘和轨道云数据中心方案,还建立全生命周期碳效率评估体系,虽有挑战但前景好。

新智元
新闻资讯7

刚刚,奥特曼亲赴,韩国「举国」投靠!

奥特曼飞赴首尔韩国总统、两大财阀巨头会晤,三星、SKOpenAI达成战略合作伙伴关系,将增加先进存储芯片供应、扩大数据中心容量,助力韩国AI发展,也加速Stargate计划落地。

新智元
新闻资讯7

马斯克删除xAI「研究员」职位引爆网络!LeCun怒批:如此暴力将扼杀创新

马斯克宣布取消xAI「研究员」头衔,强调「工程师」重要性,引发LeCun的激烈争论。LeCun认研究工程在多方面有区别,混淆会扼杀创新,争论也反映出AI企业不同组织架构模式。

新智元
算法论文8

LLM 长文本处理的“不可能三角”?我们用 E2LLM 把它破解了!

长文本理解推理是LLM的难题,存在效果、速度、兼容性的“不可能三角”。蚂蚁集团和华东师范大学提出E2LLM新范式,实现三者平衡,在效果和效率上表现出色,开启长文本处理新篇章。

PaperAgent
算法论文8

感知错误率降低30.5%:隐式感知损失让模型主动“睁大眼睛” | UIUC&阿里通义

伊利诺伊大学香槟分校阿里通义实验室推出多模态推理强化学习算法PAPO。它用隐式感知损失设计,解决感知推理脱节问题,在多基准测试中表现优,但有KL_prcp Hacking现象。

量子位
推荐文章7

跨OS GUI智能体基础设施白皮书——重新定义人机交互自动化|甲子光年智库

《跨OS GUI智能体基础设施白皮书》由庭宇科技和铸基计划联合发布,剖析GUI Agent市场格局、技术路径落地场景。指出其引发人机交互革命,能突破API局限,还介绍产品形态、发展挑战等。

甲子光年
新闻资讯7

瑞能半导体王越:汽车发展浪潮中,国产SiC器件机遇何在?

瑞能半导体王越在大会演讲,剖析碳化硅器件汽车应用前景,介绍瑞能车规级SiC产品布局。电动汽车电气架构集成化、电压平台高压化,SiC器件带来机遇,瑞能技术积累深厚,产品布局全面。

芯师爷
新闻资讯7

劝人退学、庆幸没读博浪费5年,26岁DeepMind“传奇人物”:大厂内部分散,AI研究很低效

26岁的Neel Nanda是DeepMind“传奇人物”,他涉足机械可解释性研究四年成果丰硕。在主持人对话中,他分享经验,认大厂内部分散、AI研究低效,还谈及读博、AI安全研究、公司决策等看法。

AI前线