「核心认知基准」共找到 2692 篇相关文章
小冰之父李笛智能体创业,公司取名Nextie!陆奇是股东
12月7日陆奇2025秋季「奇绩创坛路演日」,李笛压轴登场公开新创业公司明日新程(Nextie)。新团队由小冰核心初创团队构成,正计划启动千万美元融资,陆奇旗下奇绩是股东之一。公司想通过群体智能让AI有「认知」,产品预计明年1月7日上线。
OpenClaw 技术闭门:测试将比代码更值钱,Agent Computer 会是新的硬件形态
OpenClaw 持续发酵,从极客「玩具」变为生产力工具。闭门分享中,开发者们探讨了其在实际业务中的应用。如代码成负债,测试更重要;不同用户对 OpenClaw 认知差异大;Platform Engineering 成工程师核心,还提及 Agent Computer 新硬件形态等。
谷歌AI掌门人、诺奖得主Demis:AGI 需要打破“金鱼记忆”,而谷歌无论泡沫破裂与否都将是赢家
谷歌AI掌门人Demis接受专访,回应AI是否有“金鱼记忆”、AGI定义等尖锐问题。他认为通往AGI需突破,大模型是核心组件;真正AGI要能执行人类所有认知任务,离实现还有5 - 10年;还看好智能眼镜,强调保护用户对AI信任。
Andrej Karpathy最新万字采访:AGI还需10年,RL其实很糟糕,AGI不会导致经济大爆发
Andrej Karpathy在两小时万字采访里阐述AI观点。他认为AGI还需十年,强化学习糟糕,其不会带来经济爆炸式增长。还分享创办Eureka的愿景,想构建“知识斜坡”,让人类在AI时代有更强认知力。
对话微分智飞高飞:看具身智能如何引发飞行认知革命 | GAIR 2025
雷峰网第八届GAIR大会邀请微分智飞高飞,探讨具身智能在飞行机器人领域应用。高飞指出其与传统无人机本质区别,介绍应用场景、分布式集群技术,还谈世界模型价值、挑战及创业契机,认为具身智能是历史拐点。
跨越技术与法律的壁垒:AI赋能知识产权领域任务全能评测基准IPBench发布
本推文介绍arXiv论文《IPBench: Benchmarking the Knowledge of Large Language Models in Intellectual Property》。论文提出IPBench评估基准,构建含20个任务、10374个双语数据点的基准,评估17个主流模型,揭示现有模型在IP任务中局限。
具身智能迈入下半场,RoboMemArena全面评测机器人记忆系统
香港科技大学(广州)等多机构打造具身智能评测基准 RoboMemArena,突破传统局限,构建综合评测体系,配套真机测评。它提供多模态标注,任务长程多样,开源资源易用,PrediMem 在其上表现出色。
短视频刷多了AI也会变蠢!“年度最令人不安的论文”
最新研究显示,大模型灌多垃圾内容会‘脑损伤’,研究人员用不同维度定义垃圾数据并训练模型,测试其核心能力,发现垃圾数据致认知下降,且损伤不可逆,还给出行业启发。
李飞飞万字长文爆了!定义AI下一个十年
李飞飞新文指出AI下一个前沿是「空间智能」,揭秘其「世界模型」核心框架和三大核心支柱。构建具备空间智能的AI需世界模型,其应用涵盖创意、机器人、科学医疗等领域,有望提升人类生活。
Karpathy 回应争议:RL 不是真的不行,Agent 还需要十年的预测其实很乐观
Andrej Karpathy 在与知名播客主持人 Dwarkesh Patel 的对谈中指出当下 LLMs 研究进展、Agents 存在的实际问题,如‘AGI 仍需十年时间’‘LLM 认知有缺陷’‘强化学习很糟糕’等。他还对关键争议点做了补充回应,包括对 AGI 时间线、强化学习局限性等的看法。