新版图灵测试」共找到 4977 篇相关文章

算法论文8

LLM算力告急?把文本变图片,推理成本直接减半!

大型语言模型处理长文本时计算成本高,本论文探索‘文本即图像’输入压缩策略,将长文本渲染为图像输入多模态模型,可减少近一半令牌,且任务性能不受显著影响,在多任务中验证了其有效性。

深度学习自然语言处理
开源动态8

世界模型和具身大脑最突破:90%生成数据,VLA性能暴涨300%|开源

国产世界模型玩家获突破,VLA模型性能涨300%,90%训练数据由世界模型生成。极佳视界开源GigaWorld - 0及训练框架,在多方面优化,经对比性能领先,还验证其生成数据对具身任务的提升作用。

量子位
推荐文章8

超实用提示词模板!AI科学家教你用协作提示词激发大模型潜力

文章由知名AI科学家Lance Eliot所写,指出主流大语言模型因训练机制变得‘短视’,缺乏深度协作能力。介绍协作提示词技术,能让AI成为主动引导者,并以测试展示效果,还说明了适用场景。

AIGC开放社区
推荐文章8

95 后团队做 3D 大模型,拿下头部游戏重磅合作,正在定义 3D 生成的规则

影眸科技年轻团队携 3D 生成模型 Rodin 获头部游戏合作。其研究入选 SIGGRAPH 最佳论文提名,还完成融资。模型 Rodin Gen - 2 提升生成质量与可控性,在多领域应用,定义 3D 生成规则。

Founder Park
7

AI写论文,AI评阅!AI顶会ICLR完成「AI闭环」,1/5审稿意见纯AI给出

在号称「史上最严管控AI」的顶级会议ICLR 2026上,超五分之一审稿意见由大模型一键生成。这发生在ICLR颁布史上最严LLM规定后不久,引发诸多争议,也凸显AI改写科学评审分工的趋势。

新智元
算法论文8

6款小游戏难倒所有顶级VLM!愤怒的小鸟让它们全军覆没,性能不如随机猜测

淘天集团未来生活实验室提出首个系统性评估多模态大模型(VLM)交互式物理推理能力的综合基准DeepPHY。它集成六个物理环境,对17个主流VLM测试,揭示其在物理交互等方面短板。

量子位
开源动态8

NeurIPS 2025 | 中科大、港中深、通义千问联合发布CoRT:仅30个样本教会大模型高效推理,token消耗降低50%

大型推理模型在精确数学计算上存在问题,如认知冲突、行为低效、数据稀缺。中科大、港中深、通义千问联合推出CoRT框架,用创数据合成与多阶段训练,提升模型推理能力和效率,成果已开源。

机器之心
产品应用7

打破 AI 辅助开发碎片化困境,阿里巴巴 R2C Agent 的 AI 编程实践

文章围绕阿里巴巴 R2C Agent 的 AI 编程实践展开。指出当前 AI 辅助开发存在与生产链路结合难、协作碎片化等问题,介绍了 R2C Agent 如何驱动研发链路,阐述其框架、实施情况及未来提升 AI 渗透率的目标。

InfoQ
推荐文章7

实战·Agentic 上下文工程(下):实现一个可自我学习与进化的智能体原型

文章参考ACE论文架构与提示词设计,实现可自我学习与进化的ACE智能体原型。介绍整体架构、各模块实现逻辑、工作流组装测试,也指出当前问题如LLM表现波动大等,并给出改进方向。

AI大模型应用实践
新闻资讯7

才知道百度和阿里为什么能联手瓜分市场了

AI热度未减但问题转变,企业更关注全栈能力。沙利文报告显示2025年上半年阿里云和百度智能云占一站式AI云市场超一半。阿里和百度长期投入,全栈能力让其在竞争中更笃定,苹果也选它们为中国AI伙伴。

MacTalk