实验结果」共找到 1739 篇相关文章

算法论文8

AI终于学会「读懂人心」,带飞DeepSeek R1,OpenAI o3等模型

威斯康星大学麦迪逊分校联合清华的研究《MetaMind: Modeling Human Social Thoughts with Metacognitive Multi-Agent Systems》,将元认知理论融入LLM架构,使模型在心智理论测试达人类平均水平,揭示构建社交智能AI方法论。

AINLPer
算法论文8

用更一致的轨迹、更少的解码步数「驯服」掩码扩散语言模型,扩散语言模型的推理性能和效率大幅提升

扩散大语言模型发展迅猛,或成下一代大语言模型基础范式有力竞争者。复旦大学等团队发布论文,提出高效解码策略与强化学习训练组合,解决MDLM解码和训练问题,提升推理性能与效率。

机器之心
7

全球首个AI投资大赛落幕!阿里Qwen 20%收益夺冠,GPT-5亏到只剩三成

历时17天的AI实盘投资大赛Alpha Arena落幕,阿里千问Qwen精准操盘,收益率超20%夺冠,DeepSeek位列第二,两款中国模型包揽冠亚军且是唯二盈利者,美系四大模型全线亏损,GPT - 5亏超60%垫底。

量子位
算法论文8

更少的token生成更好的图!香港大学联合阶跃星辰等让AI绘画真正理解了再画

香港大学、阶跃星辰等用VFMTok新方法,让图像生成模型借用顶级视觉AI的眼睛看世界,实现更快、高质量图像生成,且无需复杂引导技巧。它改变图像理解方式,将像素死记硬背转为语义理解。

AIGC开放社区
新闻资讯8

赵长鹏投了一个华人大三学生,1100 万美元种子轮,做教育 Agent

华人大三学生 Kai Zhao 创立的教育 Agent 产品 VideoTutor,获 1100 万美元种子轮融资。该产品主打生成专属教学视频,解决 K12 美国高考学习痛点,团队技术与市场表现出色,还分享了硅谷大学生创业趋势。

Founder Park
新闻资讯7

创新中心 | 2025首届“幻镜”AI视听测评季成果在京发布,探索AI视听领域建立科学测评体系

2025年10月28日,“人工智能赋能精品创作沙龙”暨首届“幻镜”AI视听测评季成果发布会在京举办,活动旨在为AI视听领域建科学测评体系。会上公布测评结果、优秀作品片单,发布研究分析报告。

郎园Station
算法论文8

自适应Agent基础模型:从“会推理/会用工具”到“懂得取舍的执行者”

当前大型语言模型在智能体/工具调用场景有推理型和工具型两类,存在效率与功能、深度的矛盾。A²FM框架提出多模式自适应路由,实现模式自适应切换,在多基准测试中效果与效率双升。

深度学习自然语言处理
开源动态8

地理学的AlphaEvolve?MIT斯坦福让AI自我生长、懂地理、懂世界

MIT和斯坦福学者提出GeoEvolve,把地理知识「嵌入」AI,让其成为能自主改进算法的科研合作者。它有双循环机制和四个核心模块,输入简单,开源为Python包,改进Kriging模型效果显著。

新智元
算法论文7

骂得越狠,ChatGPT回答越准!PSU研究实锤,狂飙84%准确率

宾夕法尼亚州立大学团队研究发现,对ChatGPT越粗鲁,它回答越准。实验用含50个基础问题的数据集,改写为五种礼貌等级共250个prompt测试,非常粗鲁时准确率达84.8%,非常礼貌为80.8%。

新智元
算法论文8

NeurIPS 2025 Spotlight | PhysX-3D:面向真实物理世界的3D资产生成范式

论文由南洋理工大学 - 商汤联合研究中心 S - Lab 及上海人工智能实验室合作完成,提出首个系统性标注的物理基础 3D 数据集 PhysXNet 及扩展版 PhysXNet - XL,还提出 3D 生成框架 PhysXGen,实现从图像到真实 3D 资产的生成。

机器之心