康奈尔大学」共找到 5372 篇相关文章

开源动态8

世界模型评测的最盲区,被这个新基准捅破了

过去一年,‘世界模型’成视频生成领域热词,厂商强调产品要模拟真实世界运行规律,但业界评测一直未能精准检验其‘物体恒存’的认知能力。为此,研究者提出新基准MemoBench,测试了主流模型,揭示其短板。

机器之心
开源动态8

登上 GitHub 日榜 TOP5,收获 1.2 万标星的自动剪辑视频开源工具。

video-use是browser-use团队开源的自动剪视频项目,登上GitHub日榜TOP5、获1.2万标星。它改变剪辑交互方式,让用户描述意图,有智能剪辑、调色等功能。技术亮点是双层读取系统,成本和效率更优。

开源星探
推荐文章7

拆解AI短剧流水线:4道技术关卡,和一个反直觉的赚钱真相

文章拆解AI短剧流水线,介绍其要解决的核心问题,用框架分析四道收敛闸门,提及主流工具组合,还算了成本账,指出产能涨但公司巨亏,赚钱关键从制作转向投流。

AI Reading Hub
新闻资讯8

断网解题,Claude Mythos推翻Erdős 80年猜想!比OpenAI更短更漂亮

OpenAI用125页思维链解开Erdős 80年猜想,Anthropic研究员Levent Alpoge让Mythos断网测试,找到更短更简洁路径。Mythos用数论方法打破僵局,过去一周OpenAI、DeepMind、Anthropic分别攻克相关难题。

新智元
8

国产GPU组了个开源局,把SGLang等核心开发者都摇来了!

国产GPU玩家摩尔线程举办SGLang × MUSA Meetup,邀请众多开源圈开发者。活动探讨如何让国产GPU进入模型推理主流开源工程链路,显示国产GPU竞争迈向生态坐标之争。

量子位
开源动态8

一天斩获2.5k星星!首个可以「让AI直接画CAD」的开源项目来了

新开源项目text - to - cad很猛,只需把需求告诉AI,它就能生成可编辑3D模型、导出文件,还能预检。支持多格式,有几何引用等特点,一天获2.5k星。

开源AI项目落地
新闻资讯7

The Batch: 952 | GPT-5.5 性能领先,但幻觉问题突出

OpenAI 最新旗舰模型 GPT-5.5 是闭源视觉 - 语言模型,在重要基准测试中表现领先,但在区分已知未知内容上有困难,幻觉问题突出,在主观评估中落后于对手。

DeeplearningAI
开源动态8

原生理解生成统一:商汤开源SenseNova U1,用统一架构终结「缝合怪」多模态

商汤开源日日新 SenseNova U1 系列原生理解生成统一模型,采用 NEO-unify 架构,只需 8B 小参数就能实现很多商业闭源模型效果。在多测评维度性能领先,还能实现连续性图文创作输出,解决理解与生成断层问题。

机器之心
算法论文8

AI「看不懂」、「做不好」视频的问题,混元用「MTSS」解决了

腾讯混元团队提出 Multi-Stream Scene Script(MTSS)新视频描述范式,将传统方式升级为‘多流结构化剧本’。它解决了传统方式语义冗余、扩展性差等问题,在视频理解和生成任务表现显著。

机器之心
推荐文章8

Claude Code 开发者分享:如何管理百万上下文

Claude Code开发者Thariq分享管理百万上下文的心得。介绍了context概念、腐烂问题及压缩机制,提出完成操作后的五条岔路,还给出不同场景的决策建议,强调会话管理要平衡信息量和注意力。

AGI Hunt