中数睿智」共找到 2931 篇相关文章

算法论文8

首创像素空间推理,7B模型领先GPT-4o,让VLM能像人类一样「眼脑并用」

当前主流视觉语言模型(VLM)依赖文本token间接翻译视觉信息,缺乏直接视觉操作能力。滑铁卢大学等团队提出「像素空间推理」范式,让VLM能像人类一样「眼脑并用」,在四大视觉推理基准测试,7B的Pixel - Reasoner表现碾压GPT - 4o等。

量子位
新闻资讯8

西湖大学于开丞创业做概念世界模型,过亿元融资后首次公开发声

2023 年于开丞做世界模型无人看好,如今该领域大热。他曾否定自己成功工作,提出“概念世界模型”解决泛化问题。其创办的西湖智已融资超 1 亿,还分享了技术路线及对行业的看法。

DeepTech深科技
新闻资讯7

刚刚!Claude Fable 5,又拿第一了

在刚刚刷新的MirrorCode排行榜上,Claude Fable 5以64%的绝对成功率登顶,成绩远超其他模型。它在不同语言上表现稳定,在稀缺语言也只小幅度下降。这意味着前沿模型能独立完成部分大型软件。

新智元
算法论文7

又一推理新范式:将LLM自身视作「改进操作符」,突破长思维链极限

Meta等机构研究者将LLM视为「思维」改进操作符,探究并行 - 蒸馏 - 精炼(PDR)推理方法。实验显示,PDR在学任务提升准确率,还训练8B模型让推理方法更适配,减少训练与部署的不匹配。

机器之心
产品应用7

刚刚,谷歌放出Nano Banana六大正宗Prompt玩法,手残党速来

谷歌 Nano Banana 被网友玩出花样,背后是巧妙提示词的功劳。刚刚谷歌官方公布了该模型六个文本转图像提示,可进行文本生成图像等操作,还给出对应提示模板,不过使用也存在一些问题。

机器之心
算法论文8

提示工程死亡?不,它刚刚重生为计算科学:一篇讲透Prompt设计的科学基础

大型语言模型在多步推理任务受挫,因Transformer架构有计算深度限制。本文建立提示设计理论框架,揭示提示是信息选择器,优化提示可使推理性能提升超50%,将提示设计从试错艺术变为可计算科学。

深度学习自然语言处理
新闻资讯8

Sam Altman提醒创业者:ChatGPT将来要做的,大家就绕开吧

在Y Combinator举办的AI Startup School活动采访,OpenAI CEO Sam Altman复盘创业历程,分享对AI未来的看法,包括从问答工具到智能体的进化、对软件和机器人行业的影响,还为创业者给出战术建议。

机器之心
算法论文8

怎么量化机器人据价值?ATHENA将影响函扩展到十亿参VLA,313×加速筛选高价值

具身智能进入据scaling时代,VLA模型训练据并非越多越好。上海交大同济等校团队提出ATHENA框架,将影响函扩展到十亿参VLA模型,解决计算和筛选难题,实现313倍加速,实验证明其用更少据获更好效果。

机器之心
算法论文8

告别多奖励跷跷板:Flow-OPD将多教师OPD带入图像生成

国科学技术大学等机构团队提出Flow - OPD,这是首个将OPD引入流匹配模型的统一多任务后训练框架。它解决了流匹配模型后训练对齐多任务的梯度冲突等问题,效果良好,未来有多个拓展方向。

机器之心
新闻资讯8

88岁图灵奖得主,用Claude一小时破解30年学悬案

88岁图灵奖得主高德纳发文称,他研究周、可追溯到30年前的三维图论开放问题,被Claude Opus 4.6仅用1小时、31次探索就破解,还给出通用构造算法,这让向来对生成式AI保留的他致敬Claude。

量子位