模型能力」共找到 9070 篇相关文章

算法论文8

NeurIPS 2025|CAKE:大模型驱动的贝叶斯优化新配方,让黑箱优化更智能、更高效

香港中文大学(深圳)等高校研究人员提出 CAKE 方法,被 NeurIPS 2025 接收。它利用大语言模型动态设计高斯过程核函数,构建自适应贝叶斯优化框架,在多领域实验中效果优,还具备可解释性。

机器之心
开源动态8

分割一切并不够,还要3D重建一切,SAM 3D来了

深夜 Meta 重大更新,上线 SAM 3D、SAM 3。SAM 3D 含物体与场景重建、人体形状与姿态估计两模型,能将 2D 图转 3D 重建结果。SAM 3 可检测、分割与跟踪图像视频物体。Meta 开放模型权重与代码,推体验平台。

机器之心
开源动态7

开源播客TTS神器!高效TTS模型:Muyan-TTS,0.33秒生成1秒音频,零样本语音合成!

介绍新发布的开源TTS模型Muyan - TTS,它专为播客场景设计,以超低延迟实现零样本语音合成,预训练大量播客数据,支持长内容连贯生成,还介绍了使用步骤、适用场景等。

开源星探
新闻资讯8

LeCun怒揭机器人最大骗局,坦白Llama与我无瓜!

Meta首席AI科学家LeCun在MIT演讲称,机器人行业离通用智能还远,家用机器人需AI突破,核心是打造‘世界模型’架构。此观点引特斯拉、Figure高管回怼。他还表示LLM有本质瓶颈,世界模型将成未来AI主流。

新智元
产品应用7

对话MossCode:估值1亿美金的AI运动手表,想给用户构建一套「个人运动能力Context」

AI智能运动穿戴赛道正火,MossCode获数千万元天使轮融资,估值达一亿美元。其创始团队背景强大,想打破运动行业「苦难叙事」,用AI理解个体差异,为用户打造更贴合需求的运动手表。

Founder Park
新闻资讯8

GPT-5.2果然反超谷歌Gemini 3 Pro!北大数院校友核心贡献

OpenAI在成立十周年推出GPT - 5.2,相比GPT - 5.1在多实用领域更强,视觉理解等能力提升。ARC - AGI测试中得分超谷歌Gemini 3 Pro。拆解其多方面能力,还介绍核心团队多为数学专业新面孔。

量子位
算法论文8

ICML 2025 | 清华、上海AI Lab等提出傅里叶位置编码,多项任务远超RoPE

长文本能力对语言模型重要,但现有模型训练窗长有限,流行的RoPE也有局限。清华、上海AI Lab团队用傅里叶分析解读其不足,提出傅里叶位置编码FoPE,提升长文本泛化能力,实验表现超RoPE。

机器之心
产品应用8

太炸裂了!全网实测Nano Banana Pro,网友:这模型里到底装了什么鬼东西!

谷歌Nano Banana Pro出世引发全网关注,它又名Gemini 3 Pro Image,整合多模态理解能力与知识库。普通用户可在Gemini应用免费体验,实测显示其实力强悍,还在网友手中玩出花,谷歌CEO也站台。

量子位
算法论文8

RL训练一层就够了!单层RL超越全参数训练,跨任务跨模型跨算法全部验证

明尼苏达大学、北大和亚马逊团队研究发现,RL收益集中在中间层,训练单层可超全参数训练。他们提出层贡献度指标,经多模型、算法、任务实验验证,还给出三种训练优化策略。

机器之心
产品应用7

用户太蠢不配用 Fable?被Anthropic的回应气笑了:最贵的模型,最憋屈的体验

Anthropic推出Fable 5,有限时优惠但价格贵,新回退机制引争议,很多请求被降级。其曾强调安全,却用隐蔽方式编码用户信息,引发开发者不满,与OpenAI竞争也面临挑战。

InfoQ