新版图灵测试」共找到 4940 篇相关文章

算法论文8

模型汤做法!Meta|提出“类别专家汤”:SoCE,大幅提升模型性能,刷SoTA!

大语言模型领域,提升性能常需高算力、大量数据和长时间训练。Meta提出型模型汤技术SoCE,通过分析类别相关性操纵模型权重,在BFCL上刷SOTA记录,为开源社区指明低成本进化之路。

AINLPer
算法论文8

比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗

英伟达研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握动作、泛化到环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。

新智元
新闻资讯7

900亿天津科技巨头,抓紧押注算力

人工智能产业爆发,算力成竞争核心。中科曙光股价乘风而起,但营收下滑、净利润增速放缓,创始人隐退、控股股东减持带来考验。不过其全产业链布局或打开空间,1 - 3月已恢复增长。

芯师爷
产品应用8

Claude悄悄更了Skills生成器,这绝对是一次史诗级升级。

Anthropic的Claude悄悄更了Skills生成器Skill - creator,此次是史诗级升级,增评估系统、基准测试、多代理并行测试、描述调优等4个全能力,还演示了其使用方法和效果,建议更并优化评估所有Skills。

数字生命卡兹克
算法论文7

大模型在具身推理上「翻车」了?4496 道题全面揭示短板

美国东北大学等提出BEAR基准评估MLLM具身智能子能力,用4496道题测试20个模型。发现多模态大模型具身能力不足,还分析错因,开发BEAR - Agent提升模型具身推理能力,在仿真测试中效果显著。

机器之心
产品应用8

5亿融资后清华具身团队首秀:55自由度拿捏360°大旋转,街舞叠衣服都在行,手速堪比电竞选手

这是星动L7机器人秀出的最能力,打造者是清华叉院背景的星动纪元团队。不久前他们获近5亿融资,此次进展惊艳众人,该机器人全身多达55个自由度,创下多项纪录。

量子位
算法论文7

八年后,Meta教会了Transformer「显式思考」

10月20日Meta上线论文《The Free Transformer》,作者François重写Transformer思维方式,造出Free Transformer架构。它在解码器内加入随机潜在变量,让模型生成内容前先‘思考’,实验显示在多任务上性能显著提升。

机器之心
算法论文8

LLM 长文本处理的“不可能三角”?我们用 E2LLM 把它破解了!

长文本理解与推理是LLM的难题,存在效果、速度、兼容性的“不可能三角”。蚂蚁集团和华东师范大学提出E2LLM范式,实现三者平衡,在效果和效率上表现出色,开启长文本处理篇章。

PaperAgent
算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入阶段,下半场关键在评估模型真实智能。加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。

机器之心
产品应用8

1/10成本、Opus 4.7级表现,Cursor甩出了性价比之王Composer 2.5

Cursor推出模型Composer 2.5,成本仅为Claude Opus 4.7的1/10,性能几乎追平。它更智能,擅长处理长时任务,遵循复杂指令更可靠。未来一周使用额度翻倍,还宣布与SpaceXAI合作训练模型。

机器之心