新词新站比赛」共找到 3659 篇相关文章

算法论文8

都在卷「让大模型多循环几遍」,这个7B模型LoopCoder v2说:多循环 1 次就够了

当下推理模型流行在测试时多循环,以打磨答案。但研究发现,7B模型LoopCoder v2只多循环1次(共2次),就能大幅提升性能,继续增加循环次数,性能反而下降。研究还分析了收益与成本,给出选择循环次数的诊断方法。

机器之心
产品应用8

我用1分钟开发了个上线应用,有阿里Meoo谁还学编程啊

阿里出AI开发工具Meoo(秒悟),全程无需写代码,通过说话提需求,1分钟就能生成可上线、可分享、可交互的完整应用。它内置阿里云全家桶,能自动完成云服务环境搭建、数据库配置等,还支持创意社区和多人协作。

量子位
新闻资讯7

特斯拉们,慌了?英伟达智能驾驶实测曝光:仅用一年追平马斯克八年心血

英伟达汽车业务虽仅占总收入1%,但十年积累已成气候。其与Uber合作、推广L2级城市功能,到2028年将实现L3高速公路驾驶,仅用1年几乎追上马斯克的FSD。实测中英伟达自动驾驶表现出色,系统也有诸多亮点。

新智元
新闻资讯8

A16Z发布最AI应用榜单,中国产品强势崛起

a16z发布第五期消费级AI应用排行榜,此榜单已成观察AI日常使用趋势的重要指标。面孔减少,生态趋于稳定。Google发力,多个产品入榜;Grok表现佳,Meta AI欠佳;中国产品崛起,多个上榜;‘Vibe Coding’平台带动其他工具增长。

AI工程化
新闻资讯7

下一站AI创业主线:别卷模型了,把这件事干成才重要

在AGI Playground 2025上,极客公园张鹏与三位投资人探讨Agent时代投资。他们认为AI创业进入「拼交付」时代,多模态短期影响被高估、长期潜力被低估,通用Agent是巨头之争,垂直Agent是创业机会,还会催生基础设施,付费模式向按结果付费演变。

Founder Park
开源动态7

GPT-5得分不到0.4!法律+金融最大规模基准:1.9万+专家评估准则

推出的PRBench基准可测AI在金融和法律领域表现。它有19356条专家评估准则,是该领域最大公开基准。顶尖大模型在困难子集得分低,还独创经济路径分析维度,约30%任务为多轮对话,揭示了AI在专业领域的不足。

新智元
产品应用8

业界首个高质量原生3D组件生成模型来了!来自腾讯混元团队

腾讯混元3D团队推出业界首个高质量原生3D组件生成模型Hunyuan3D - Part。现有3D生成算法有局限,该模型提出范式,含P3 - SAM和X - Part,在多数据集评估中超越现有工作,还给出体验地址和论文地址。

量子位
开源动态8

腾讯智能体开源大动作!关键技术都拿出来了,开发平台还全面升级

在2025腾讯全球数字生态大会上,腾讯云智能体开发平台3.0(ADP3.0)面向全球上线,关键智能体技术将持续开源。版本功能更多,还有多个落地案例,如帮伊利、华住等落地智能体。腾讯优图实验室也有开源计划。

量子位
新闻资讯8

完成过亿融资,复旦博士要为不同端侧场景定制专属推理芯片丨对话淬思科技潘鸿洋

本文是对淬思科技创始人潘鸿洋的专访,潘鸿洋为复旦博士,淬思科技刚完成一轮亿元融资,瞄准端侧AI推理成熟阶段的碎片化需求,主打定制专属推理芯片,采用AI原生设计流程压缩开发成本与周期,计划推进首颗商用芯片流片。

DeepTech深科技
算法论文8

南大团队直击大模型高分神话:人类90分,最强模型仅49分

南京大学傅朝友团队在Google Gemini评测团队邀约下推出视频理解基准Video - MME - v2。它有创的分层能力体系与组级非线性评分,经超3300人工时标注。评测显示模型与人类差距大,还揭示传统Acc指标虚高、‘Thinking’并非总增益等现象。

新智元