大而美法案」共找到 5516 篇相关文章

新闻资讯7

对话智源王仲远:具身智能“小组赛”才刚刚开打,机器人需要“安卓”非 iOS

智源研究院院长王仲远在对话中指出语言模型发展遇瓶颈,AI 需走向物理世界。智源推出“悟界”系列,试图打破具身智能“循环悖论”,做具身智能的“安卓”,还提出小脑协同策略,认为具身智能“小组赛”未结束。

AI科技大本营
算法论文8

为什么模型会产生幻觉?OpenAI最新研究终于搞清楚了

OpenAI发布研究论文剖析LLM幻觉根源,指出当前主流训练与评估体系是核心驱动因素之一。现行评估奖励猜测行为,幻觉起源于预训练的‘下一词预测’,论文还澄清五误区,建议改革评估体系。

AI寒武纪
开源动态8

狂揽 11.8K Star!用厂 PUA 话术「驯化」AI,这个项目把 Claude 逼成了卷王!

GitHub上名为PUA的项目狂揽11.8K Star,作者用厂PUA话术‘驯化’AI,总结了AI的‘五摆烂行为’,建立‘心理学框架’,实测数据显示能提升AI编程效率,还介绍了安装方式和常用命令。

开源星探
产品应用7

高考数学全卷重赛!一道题难倒所有模型,新选手Gemini夺冠,豆包DeepSeek并列第二

因网友质疑上次测评不严谨,此次用六款模型挑战含解答题的全套高考数学题。结果Gemini 2.5 Pro夺冠,Doubao和DeepSeek R1并列第二。解答题是失分重灾区,图像题难倒多模态模型。

机器之心
开源动态8

小红书开源模型dots.llm1,初次出手,小有惊艳!国外网友们又炸了……

小红书hi lab团队公布首个开源模型dots.llm1,这是142B参数的MoE模型,仅14B激活参数就能与Qwen2.5 - 72B打平。它开源力度,训练效率高,数据处理精细,训练稳定,获国外网友高度关注。

AGI Hunt
算法论文8

世界首个!李飞飞团队推出物理推理基准,模型统统不及格?

斯坦福联合中科团队推出世界首个评估视觉语言模型物理推理能力的基准QuantiPhy,通过测试发现顶尖模型在数值计算上不如人类,还揭示模型推理靠记忆非测量,为AI发展指明方向。

AIGC开放社区
推荐文章7

OCR-Reasoning:揭秘多模态模型在复杂图文推理中的真实能力

主流OCR评测基准聚焦信息抽取任务,图文推理任务缺乏系统性评估标准。OCR - Reasoning可系统性评估多模态模型深度推理能力,还给出多种推理示例,并展示了测评Qwen2.5 - VL - 7B模型的代码。

PaperAgent
开源动态8

不会拍照有招了!北彭宇新团队开源首个美学指导模型Venus,帮你拍好照|CVPR 2026

彭宇新教授团队针对现有模型在摄影指导上的不足,定义美学指导任务,构建数据集AesGuide,提出美学指导模型Venus。相关论文被CVPR 2026接收并已开源,Venus在多项评测中优于现有方法。

量子位
新闻资讯8

中国团队引领太空算力:首次太空在轨部署通用模型,发2800颗卫星服务数亿硅基智能体

岁末年初,全球AI竞争聚焦太空算力,中美你追我赶。美国Starcloud宣布在太空跑通模型,中国国星宇航发布全球首个服务硅基智能体的太空算力网,计划用2800颗卫星服务数亿个硅基智能体,还实现通用模型在轨部署。

量子位
算法论文8

AI画手总是六根手指?阿/美团/上交首次系统量化扩散模型计数幻觉

阿德莱德学、美团和上海交通学团队首次系统研究扩散模型“计数幻觉”问题。构建CountHalluSet数据集套件量化该问题,揭示其与采样条件的关系,还提出JDM模型缓解计数幻觉。

量子位