「飞书大会」共找到 6045 篇相关文章
Meta新研究:字节模型蒸馏后,天花板破了
本文介绍Meta FAIR与华盛顿大学合作的最新研究,针对传统大模型蒸馏Token候选空间大、存储成本高的痛点,提出字节级蒸馏方案,验证其可突破Token天花板提升模型能力上限。
7B打败o3、GPT-5!医学AI智能体让模型学会“看哪里、怎么看”
上海创智学院LeapQuest团队联合多校,在ICML 2026接收两篇论文,提出“Think with Images/Think with Videos”范式,让视觉证据参与模型推理,Ophiuchus和MedScope分别用于图像和视频诊断,表现出色。
触觉具身来了个梦之队:天使轮近亿
5月27日,上海新智具身智能科技有限公司宣布完成近亿元天使轮融资。该公司源自复旦大学,核心团队实力强。它聚焦触觉具身智能,构建技术闭环,在数据采集、模型训练等方面有进展,已在工厂落地POC验证订单。
OpenAI又曝出内讧了!IPO前夜高层大换血
OpenAI在冲刺IPO之际,高层现剧烈人事动荡,COO转岗,多位核心高管离职或休假;CEO奥特曼与CFO因IPO时间表分歧失和,奥特曼求快,CFO求稳,公司财务压力也不容小觑。
黄仁勋砸千亿兆瓦算力,押注下一个“Open AI”
3月10日,前OpenAI高管Mira Murati创办的Thinking Machines Lab与英伟达达成长期合作,英伟达将提供1吉瓦下一代NVIDIA Vera Rubin系统。这一合作规模巨大,显示英伟达全面布局,也体现该创业公司野心,不过其面临组织动荡考验。
CUDA再见了!寒武纪亮出软件全家桶
在AI时代,竞争转向软件生态等综合实力。寒武纪亮出软件全家桶,其基础软件平台Cambricon NeuWare日趋成熟。在训推解决方案上成果显著,各组件如驱动、编译器等也有诸多优化和功能,加速产业智能化转型。
高效大规模创新3D重建模型iLRM
多数基于Transformer架构的模型处理多视图输入有可扩展性问题,成均馆大学、延世大学研究人员提出创新3D重建模型iLRM。它通过迭代细化机制生成3D高斯表示,有独特架构设计和高效注意力机制。
李建忠对话菲尔兹奖得主Timothy Gowers:整个数学研究的范式将被AI改变
奇点智能研究院院长李建忠与菲尔兹奖得主Timothy Gowers对话,探讨AI与数学研究的十个话题,涉及数学重塑AI、AI推理能力、自动形式化、数学研究未来及AI对数学教育的影响等。
HeyGen 开源了一个"用 HTML 写视频"的框架,我研究了一下,发现事情没那么简单
HeyGen 开源了 Hyperframes 项目,可让 AI 用 HTML 写视频。文章从其定义、上手教程、竞品对比等方面展开,指出它虽有短板,但代表视频制作新范式,建议相关从业者关注尝试。
清华刘知远团队论文:最小化结构改动,短文本到长文本丝滑升级 | ICLR 2026
大语言模型发展中,上下文长度成关键瓶颈,主流架构计算开销大。清华刘知远团队提出《InfLLM-V2: Dense-Sparse Switchable Attention for Seamless Short-to-Long Adaptation》,提出可切换注意力框架,为长上下文研究提供新思路。