新版图灵测试」共找到 4902 篇相关文章

开源动态8

Chain-of-Agents: OPPO推出通用智能体模型范式,多榜单SOTA,模型代码数据全开源

OPPO个性化AI实验室团队推出智能体推理范式CoA及模型AFM,解决传统多智能体系统通信效率低等问题。AFM在近20项测试中刷记录,降低推理成本,还介绍了架构、数据构建等,也指出待探索方向。

机器之心
开源动态8

打破AI能力的惯性评估方式,红杉中国推出全双轨基准测试xbench|甲子光年

红杉中国推出全AI基准测试工具xbench,采用双轨评估体系,构建多维度测评数据集,追踪模型理论能力上限与Agent实际落地价值。还采用长青评估机制,首期发布两个核心评估集并给出综合排名,公开后邀各界完善。

甲子光年
算法论文8

斯坦福&英伟达提出范式:推翻Scale Law,在“推理”阶段自我进化,超越人类专家

斯坦福和英伟达提出 TTT - Discover 范式,允许模型在测试时继续训练,针对难题‘进化’。它设计了自适应熵目标函数和 PUCT 状态复用组件,实验在多领域碾压人类专家与同行,但在部分领域落地有局限且计算成本高。

深度学习自然语言处理
新闻资讯8

突破三维感知瓶颈:魔芯科技发布VGGT系列成果,实现动态高保真重建并获一轮融资

魔芯科技联合同济大学等团队,基于 VGGT 架构发布四项成果,突破三维感知在流式处理、动态鲁棒性和精细感知上的瓶颈。还获一轮融资,后续将加大对空间智能与世界模型技术投入。

机器之心
新闻资讯7

代码为刃 创意为甲,探索国产AI应用路径 ——“算网杯”2025 AIGC开发者大赛圆满落幕

1月17日,“算网杯”2025 AIGC开发者大赛决赛在中国科大苏州高等研究院落幕。大赛受业界关注,吸引500余名开发者。以“探索国产AI应用路径”为导向,成果丰富,发掘了人才与项目,为产业注入动能。

AIGC开放社区
算法论文8

看似无害的提问,也能偷走RAG系统的记忆——IKEA:隐蔽高效的数据提取攻击范式

研究聚焦RAG系统,提出全黑盒攻击方法IKEA。它不依赖异常指令,通过自然查询提取私有信息。经多数据集测试,其效率和成功率高,还证实提取知识实用,揭示RAG系统潜在脆弱性。

机器之心
新闻资讯8

Karpathy盛赞DeepSeek-OCR“淘汰”tokenizer!实测如何用Claude Code 让模型跑在N卡上

DeepSeek发布模型DeepSeek - OCR,有诸多技术贡献,获Karpathy等盛赞。它或让文本token输入方式被淘汰。开发者Simon用Claude Code让其在N卡上运行成功,分享了详细过程与经验。

AI前线
开源动态8

社区发布丨全面开源!商汤日日SenseNova U1发布,迈向模型理解生成统一时代

商汤科技正式发布并开源商汤日日SenseNova U1系列原生理解生成统一模型,基于NEO - unify架构,实现模态集成向原生统一跨越,其轻量版在多项测试达同量级开源SOTA,还能连续性图文创作。

Hugging Face
开源动态7

代季峰陈天桥联手AGI首秀炸场!最强开源深度研究模型,GAIA测试82.4分超OpenAI

MiroMind ODR是代季峰加盟陈天桥后的技术首秀,GAIA测试82.4分超OpenAI。它全开源可复现,包括MiroFlow、MiroThinker等四个子项目。团队还曾推出MiroMind - M1,专注提升数学推理能力。

量子位
算法论文8

推翻「预测下一个token」范式!微信AI研究:把token压缩成连续向量更具性价比

微信AI和清华团队提出范式CALM,把token打包成连续向量,让大模型从预测下一个token转变为预测下一个向量。实验表明它能减少生成步骤,在平衡性能和计算成本时性价比更高。

量子位