世界记忆」共找到 1437 篇相关文章

新闻资讯7

大模型玩不好数独?!Transformer作者初创公司公布排行榜:o3 Mini High“变异数独”正确率仅2.9%

Transformer作者初创公司Sakana AI公布AI解决数独能力排行榜,用全新基准Sudoku - Bench考验大模型创造性推理能力。结果显示大模型总体正确率仅15%,9×9数独中高性能模型o3 Mini High正确率2.9%。

量子位
产品应用7

RoboScience机器科学发布轮式仿人形机器人REX G1,打造新一代具身生产力伙伴

8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1。它搭载自研VLOA架构通用具身大模型Visics,面向多场景,能在真实世界完成任务闭环,具备多方面优势。

机器之心
新闻资讯7

别再所有人平分AI算力:顶级模型给资深工程师才省钱,新人刷题式成长已失效

在2026世界人工智能大会InfoQ直播间,滕昱和唐飞虎探讨AI Coding深层变化。他们认为AI放大资深工程师能力,冲击新人与大型软件组织,还就模型使用、判断力、企业部署等发表见解。

InfoQ
新闻资讯7

AI短片节创作者招募:在崇礼,用AI讲一个未来故事|甲子光年

「Future Now/未来此刻」2026夏季崇礼论坛将启幕,设立「Chongli AI Film Lab」专场论坛,发起AI短片节。面向全球创作者征集作品,有两大创作方向,生数科技Vidu全程支持,对作品有要求,还有丰厚奖励。

甲子光年
算法论文8

聊聊Anthropic这篇最新研究,我觉得可能是AI意识诞生的前夜。

Anthropic最新研究《A Global Workspace in Language Models》,在Claude神经网络中发现与人类大脑意识通达结构功能高度相似的J空间,这结构自发涌现,研究还证明其对Claude输出有影响,或改变人类对意识的理解。

数字生命卡兹克
算法论文8

GPT-5.4 仅 11.36%!当大规模工具生态变成迷宫,LLM Agent 还能完成长程规划吗?

PlanBench-XL 来自 UIUC 团队,将 LLM Agent 放入零售 API 世界,评测其长程规划能力。它考虑真实工具环境挑战,含 327 个任务等,发现多数模型规划难、恢复差等问题,并给出改进启示。

深度学习自然语言处理
推荐文章7

存量代码库难适配、人机边界模糊?百度拆解Coding Agent企业级落地的硬核解法

本文基于百度资深研发工程师颜志杰在2025 AICon大会演讲整理,剖析Coding Agent企业级落地三大挑战,分享百度“知识体系 + Rules建设”等实践,揭示开发者构建工程配套跨越代际鸿沟的方法。

InfoQ
新闻资讯8

寻找最强具身大脑!全球机器人顶会ICRA开启报名,智元全程陪跑带你拿奖

由智元主办的AGIBOT WORLD CHALLENGE @ICRA 2026赛事开启报名,设推理 - 操作和世界模型两赛道。智元提供顶配硬件、仿真平台、数据集和基线模型,还有超百万美元奖金与资源,助力开发者。

量子位
产品应用8

机器人GPT时刻!英伟达WAM赋予全机器人零样本操作能力

英伟达发布世界动作模型 DreamZero,通过耦合视频生成与动作预测,让机器人有物理直觉,能在陌生环境完成复杂任务。它用异构数据学习,适配不同机体,还经优化实现高速推理。

AIGC开放社区
开源动态7

小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验

开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。

AI工程化