分解式评分」共找到 731 篇相关文章

产品应用8

挑战Claude code和Cursor:阿里Qoder对标全球,AI编程迎来“上下文”革命

AI编程工具爆发增长,‘上下文’成实用化难题。阿里推出Qoder平台,结合大模型与Agent,可深度检索代码、理解上下文。本文采访Qoder团队工程师,解析其定位、成本、技术路线等关键问题。

InfoQ
算法论文7

AI 模拟消费者,预测购买意图准确率达 90%

PyMC Labs和高露洁棕榄团队研究发现,让大语言模型扮演消费者,用另一AI评分可90%准确预测购买意图,还提出SSR方法。虽有优势,但也面临质疑和局限,可增强市场调研。

AI工程化
推荐文章7

Tool-Integrated RL 会是 Agents 应用突破 「基模能力限制」 的关键吗?

文章聚焦AI & Robotics业内要事,探讨Tool - Integrated RL能否助Agents突破「基模能力限制」,还涉及Copilots填产业落地鸿沟、生成AI重塑软件开发等话题,完整版通讯含多项解读与要事速递。

机器之心
算法论文8

大模型赋能的具身智能:自主决策和具身学习技术最新综述

具身智能是通往通用人工智能的关键路径,但传统方法有泛化瓶颈。电子科大最新综述梳理大模型赋能具身智能的自主决策与具身学习,还将‘World Model’纳入统一框架,为研究者提供路线图。

PaperAgent
新闻资讯8

吴恩达:并行 Agent是 Scaling laws 的新方向

吴恩达称并行 Agent 是扩展 AI 新方向。过去 AI 靠数据和计算量提升能力,如今并行 Agent 能在不增加用户等待时间前提下提升效果,虽任务分解有难点,但研究不断涌现。

AI寒武纪
推荐文章7

相信大模型成本会下降,才是业内最大的幻觉

很多AI创业者认为模型降价能降成本、改善营收。但文章指出,成本下降仅针对老旧模型,最好模型成本大致相同,且模型token消耗激增。还探讨了AI创业商业模,如按使用量计费、建立高切换成本、垂直整合等。

Founder Park
算法论文8

该工作引来马斯克回复,让Gork破防:CoT是真正的推理,还是训练数据的统计插值?

大型语言模型(LLMs)的思维链(CoT)推理能力被视为突破性进展,但论文揭示CoT可能只是数据分布内的模匹配幻象,通过实验证明其在分布偏移时表现急剧退化,挑战主流认知。

深度学习自然语言处理
算法论文7

DeepMind让AI当「上帝」,导演一场只有AI演员的「西部世界」

Google DeepMind和多伦多大学研究人员受TTRPG和现代游戏引擎启发,提出Concordia软件库。它基于「实体 - 组件」架构,将工程师与设计师角色分开,能灵活构建多角色生成AI系统,满足不同需求。

机器之心
开源动态8

狂涨 9.1K star!最近这款谷歌的AI开源应用,超级火!

介绍Google的实验性应用`Google AI Edge Gallery`,它将生成AI模型嵌入手机,支持Android和iOS,可离线运行,有多种实用功能,在Github获9.1K star,虽处Alpha阶段但潜力大。

开源先锋
推荐文章7

我用了13年,与SEO前辈们出现在一起。白杨SEO从网站优化到AI搜索优化经历分享,百度SEO不放弃!

白杨SEO分享从网站优化到AI搜索优化经历,讲述入行缘由、职场项目,介绍自由职业业务,分析百度SEO阶段与变化,建议别放弃,还给出对SEO未来看法,如回归国外、做新媒体SEO等。

白杨SEO优化教程