上科大」共找到 6420 篇相关文章

算法论文7

SceneGen: 单图像驱动的多资产3D 场景生成

海交通学提出SceneGen框架,可从单张场景图像及其对应目标掩码中,同时生成带有几何结构与纹理的多个3D资产。它一次前向传播即可完成生成,在效率与稳健性优于现有方法,虽有局限但应用潜力

带你学AI
开源动态7

4万星开源项目被指造假!MemGPT作者开撕Mem0:为营销随便造数据,净搞没有意义的测试!

高人气开源智能体记忆项目Mem0在论文中称在LOCOMO打败所有人,MemGPT联合创始人公开指控其测试无意义、数据造假。二者都为解决模型长期记忆问题,Letta认为能力比工具重要,并给出评估智能体记忆能力的方法。

AI前线
算法论文8

AAAI 2026 Oral:明略技开创稀疏数据「信息瓶颈动态压缩」,精度+速度双SOTA

在机器人和具身智能领域,transformer模型又又‘重’,边缘设备难以承受。东南学、中南学、明略技联合提出的CompTrack论文,创新性解决AI模型处理稀疏数据的‘双重冗余’,在3D点云跟踪任务实现精度和速度双优。

机器之心
新闻资讯8

AI音乐王座易主!Mureka V8硬刚全球巨头斩获双榜第一,V9即将来袭

AI音乐模型Mureka V8在权威Artificial Analysis榜单,斩获vocal与instrument双榜单第一,碾压Suno V4.5等主流模型。其核心技术是MusiCoT,在多维度获正向反馈。昆仑万维还与太合合作,V9将探索创作意图可控表达。

新智元
算法论文8

GRPO遭遇瓶颈?G²RPO-A让自适应指导为小模型推理能力「开外挂」

模型推理能力难迁移到小模型,现有强化学习方法如GRPO在小模型性能提升有限。香港中文学(深圳)唐晓莹教授团队提出G²RPO - A算法,缓解小模型奖励稀疏问题,在多模型实验中表现优于vanilla GRPO。

机器之心
算法论文8

SAPO:让强化学习告别“硬剪切”

强化学习是提升语言模型推理能力的核心技术之一,但现有基于组的策略优化方法面临 token 级重要性比率高方差问题。GRPO 和 GSPO 采用硬剪切有学习信号丢失等缺点。为此提出 SAPO,用平滑门控函数替代硬剪切,实验效果良好。

通义千问Qwen
新闻资讯7

顶会具身辩论赛实况:徐丹飞激辩,PI连输三轮,谷歌佬倒戈

2026年RSS会workshop圆桌讨论,五位专家围绕世界模型落地展开辩论。辩题有世界与策略模型该合体还是分开、世界模型可控性靠像素还是动作、训练数据靠互联网人类视频还是具身机器人数据。最终各方有输赢也有共识。

AI科技评论
新闻资讯7

疯狂!也就2500辆车路,完成8760亿估值新融资

Waymo官宣完成160亿美元融资,估值超8760亿,较1年半前翻近3倍。其业务分Robotaxi和新业务,今年将扩张至全球20多城。中国Robotaxi玩家萝卜快跑等在业务有进展,但与Waymo的估值差距

量子位
算法论文8

27M参数战胜GPT-4!脑启发的分层Reasoning引擎如何重塑LLM

当前语言模型(LLM)核心架构存在根本性缺陷,受脑分层处理和多时间尺度启发,本文提出仅2700万参数的分层推理模型(HRM),免预训练与CoT标注,单次前向传播解决复杂任务,在ARC - AGI超越GPT - 4等LLM。

深度学习自然语言处理
算法论文7

超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭

近日MIT研究者发现测试时训练在模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集性能显著提升,超Claude 3.5等。但该策略部署效率低。

新智元