「类脑空间认知框架」共找到 1918 篇相关文章
DeepSeek V4没做的,MiniCPM-o 4.5给做「全」了~
上周 DeepSeek V4 发布,遗憾不是多模态。今天 MiniCPM-o 4.5 补上短板,凭 9B 参数实现端到端全双工全模态大模型,自 2026 年 2 月发布后 Hugging Face 下载量超 25 万。还推出多项成果,性能表现出色。
实测丨HeyGen开源HyperFrames,让AI Agent用HTML做视频
复杂视频剪辑工具对非专业人士和AI Agent不友好,HeyGen开源的HyperFrames是视频渲染框架,可让AI Agent用HTML做视频。该项目更新频繁,有HTML原生、为AI设计等特点,文末附项目链接。
Routa 桌面版发布:内建 Harness 工程的 AI Coding 研发协作工作台
Routa桌面版发布,它是内建Harness工程的AI Coding研发协作工作台。围绕Routa构建Harness工程框架,Kanban成为任务协议,多Agent沿泳道接力协作,重新定义了‘done’,让AI Coding进入协作与交付问题域。
1.1K Star!告别单打独斗!让 AI 自己组建开发团队,自动分工、沟通、合并成果!
当前单个AI Agent编程有局限,遇到复杂项目力不从心。开源项目ClawTeam-OpenClaw是多智能体群智协作框架,让AI团队协作,解决了单个AI上下文窗口有限等问题,还具备自组织、工作区隔离等亮点。
创业者出海必读,3 万字讲清 AI 产品达人营销全流程
本文作者有服务超百家AI agent产品团队出海经验,全面阐述AI产品达人营销全流程。指出其能解决产品增长难题,介绍海外博主生态,涵盖前期准备、内容适配、执行环节要点,还提及AI在其中的作用,强调建立长期合作关系。
当Sora 2意外停摆,这个国产视频生成创业团队,直接「开源」三连击
OpenAI叫停Sora 2项目,同期北京AI初创公司Sand.ai在GitHub连续三天开源核心技术栈,包括音视频同出大模型、分布式Attention组件、全局编译框架,还介绍了团队和产品,展现全栈实力。
「百万级」视频推理数据集!30+顶尖高校联合发布
AI视频生成已能「画得像」,但不会「想得对」。VBVR推出百万级视频推理数据集,首次系统评测模型对空间、物理、逻辑和抽象的推理能力,发现顶尖模型通过率仅68%,推动视频AI从「视觉模仿」迈向「智能推理」。
Anthropic公开8万人访谈:害怕AI替代我,更怕没有它
Anthropic公布对8.1万Claude用户的调查,人们向AI吐露心声,AI带来帮助同时也引发担忧。81%的人认为AI已帮到他们,人们用AI提效以掌控生活,不同地区对AI诉求不同,还存在五组期待与担忧的张力。
大模型桌游试玩员来了:用五大画像模拟「千人千面」,评分精准度超越GPT-5.1
盛大东京研究院等团队提出MeepleLM,首个能模拟玩家视角给出建设性批评的虚拟试玩模型。它构建专属数据集,引入MDA理论,提炼五种玩家画像。实验显示其评分精准度超GPT - 5.1等通用模型。
像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境
为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。