论文审稿人」共找到 2050 篇相关文章

算法论文8

清华&Qwen最新论文实证: VLM 智商与机器操控能力“零相关”

清华和 Qwen 最新论文《VLM4VLA: Revisiting Vision - Language Models in Vision - Language - Action Models》测试 24 个 VLM 模型,构建极简 VLM4VLA 测试,发现 VLM 通用能力与机器操控能力‘零相关’,还揭示视觉编码器短板。

深度学习自然语言处理
新闻资讯8

芯片团队规模近3000!小米扩张自研芯片版图

8月24日小米举行玄戒芯片技术沟通会,公布三颗自研芯片:AI旗舰SoC玄戒O3、端侧AI加速芯片玄戒O100、智驾高算力AI芯片玄戒D100。小米重启大芯片研发五年多,投入超210亿,芯片团队近3000

芯师爷
新闻资讯8

刚刚,小扎终极野心曝光:为数十亿提供个超级智能!

Meta宣布与博通定制AI芯片合作延至2029年,初始投入超1GW算力。扎克伯格称要为数十亿提供个超级智能。Meta自研MTIA芯片,两年推四代,还成立超级智能实验室,欲成AI基建主导者。

新智元
算法论文8

OmniHuman-1.5:让数字拥有“思考”的视频生成新范式

现有视频数字模型难捕捉角色本质,字节提出 OmniHuman - 1.5 框架。其核心创新是用 MLLM 提供语义引导、提出多模态 DiT 架构和伪末帧设计,使模型融合多模态信号,生成高质量角色动画。

带你学AI
开源动态8

港大开源 Paper2Slides,一条命令,把论文变成专业幻灯片!

在AI辅助办公赛道,PPT生成一直是竞争热点,但存在好看不好用、好用不准确的问题。港大开源的Paper2Slides项目,能一条命令把论文转成专业幻灯片,还能做海报,解决了AI幻觉问题。

开源星探
算法论文8

DeepSeek发布最新论文,5大杀手锏让大模型训练、推理暴涨

全球著名开源大模型平台DeepSeek在huggingface发布超强开源模型V3的论文,从硬件架构和模型设计双视角探讨高效训练和推理,提出DeepSeek - MoE、多头潜在注意力等创新技术,解决内存、计算效率等难题。

AIGC开放社区
开源动态8

字节推出X-Streamer,实时口型同步与长程记忆数字框架

字节推出端到端多模态类世界建模框架X - Streamer,能从单张像构建可无限流式生成的数字,实现音素级口型同步和长程记忆。其核心是“思考者–行动者”双Transformer架构,在两张A100 GPU上可实时运行。

带你学AI
新闻资讯7

亚马逊裁员16000,员工竟用AI「算」出了裁员名单?

近日,亚马逊开启新一轮裁员,预计影响16000,属去年约3万岗位裁员计划“收尾”。一名员工用AI工具Pippin分析内部聊天记录生成裁员名单,亚马逊未核实。此番裁员或与AI应用有关。

机器之心
开源动态8

不止动起来:SentiAvatar重新定义3D数字动作生成范式

AI 初创公司 SentiPulse 联合团队提出 3D 数字动作生成新范式 SentiAvatar,打造虚拟角色 SUSU,其框架等已全球同步开源。它解决了高质量数据荒等问题,实验表现优,还实现快速动作生成,支持流式交互。

机器之心
开源动态8

DeepSeek深夜炸场,开源了一个新项目&论文,V4打前站?

凌晨,DeepSeek开源新项目Engram并公开论文。Engram用可扩展的O(1) N - gram记忆替Transformer早期层节省算力,在多方面实验表现出色,如推理任务增幅大于知识任务,还分析了其机理和系统效率。

PaperAgent