「多人物视频生成」共找到 2722 篇相关文章
Karpathy、Claude Code之父Boris,最新访谈,把整个程序员圈炸了!
假期红衫AI Ascent 2026上,Claude Code之父Boris与Karpathy演讲引发关注。Boris称编程执行层已解决,他用Claude App工作,全公司代码由模型生成;Karpathy提出Software 3.0概念,还谈到模型能力不均匀。两人还对面试、创业等给出看法。
大模型思维链推理速度倍增!——RoT新框架把思维链「画」进隐空间
随着大模型规模扩展,思维链(CoT)成处理复杂推理任务标准范式,但显式CoT依赖长序列生成,隐式CoT面临优化挑战。腾讯提出RoT新框架,利用视觉编码器将文本推理步骤转为视觉嵌入,实现Token压缩与推理加速,且过程可分析。
明晚直播|从《黑客帝国》到迪士尼乐园:谈《拟像与拟真》
法国后现代思想大师让·波德里亚在《拟像与拟真》中预警数字时代图景。2025年12月5日19:30—21:30,豆瓣读书联合南大社·守望者邀汪民安等嘉宾,结合电影探讨波德里亚思想及拟像,直播在豆瓣读书视频号同步。
最新实测GPT-5-Codex:前端能力碾压,复杂项目轻松搞定,Claude可以扔了!
OpenAI发布GPT-5-Codex,网友称可告别Claude Code。实测其前端能力提升大,能轻松完成复杂项目,如一键生成小游戏、手稿直出网页等。虽有页面UI堆叠小瑕疵,但仍值得支持。此外,Grok 4有突破,马斯克看好Grok 5。
MIRIX重塑AI多模态长期记忆:超Gemini 410%,节省99.9%内存,APP同步上线
UCSD和NYU团队推出开源的MIRIX,全球首个多模态、多智能体AI记忆系统。它表现亮眼,在多任务中超越传统方法,有类人记忆系统等特点,还上线Mac端应用,开启大模型从对话生成到长期记忆驱动心智的新周期。
AI真有希望考清北了!豆包1.6多模态推理发威,闯关数理化带图大题
火山引擎原动力大会发布豆包大模型1.6,它是国内首款多模态SOTA模型,支持256k上下文长度。实测中它解答高考数理化带图大题表现出色,还具备图像识别、视频理解、GUI操作等能力。此外,火山引擎还推出系列工具和平台助力企业。
刚刚!北大校友Lilian Weng最新博客来了:Why We Think
北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。
CVPR 2026 ReSAM:每个目标只标1个点,SAM就能学会分割遥感图像
CVPR 2026收录论文《ReSAM: Refine, Requery, and Reinforce: Self-Prompting Point-Supervised Segmentation for Remote Sensing Images》,提出让SAM每个目标只标1个点,通过R³循环自己生成高质量伪标签训练。在WHU建筑数据集上,1点标注与全监督差距仅1.3%,省99%标注成本。
我用1分钟开发了个上线应用,有阿里Meoo谁还学编程啊
阿里新出AI开发工具Meoo(秒悟),全程无需写代码,通过说话提需求,1分钟就能生成可上线、可分享、可交互的完整应用。它内置阿里云全家桶,能自动完成云服务环境搭建、数据库配置等,还支持创意社区和多人协作。
月费3万,成本为零:谁在收割企业的GEO焦虑?| 甲子光年
GEO指针对生成式AI进行结果优化,提高品牌被纳入回答的机会。当下GEO市场乱象丛生,多数服务商报价随意、技术原始,靠“黑帽”做法捞金。不过也有行业规范派在建立标准。其背后是流量入口争夺战,未来提示词或成新货架。