「长视频编辑」共找到 1689 篇相关文章
小小具身智能成果,高中生在腾讯拿下!
腾讯2025星火挑战周上,八十余位高中生聚焦前沿课题取得诸多成果,如具身智能成果获张正友点赞。课题涉及具身智能与机器人、长文本理解等方向,不少项目有实用价值,68名同学获清北offer。
是「福尔摩斯」,也是「列文虎克」,智谱把OpenAI藏着掖着的视觉推理能力开源了
智谱开源视觉推理模型 GLM-4.5V,还同步开源桌面助手应用。此模型视觉推理能力强,在图像识别、视频理解、前端复刻、图表处理等多方面表现出色,技术创新使其达开源 SOTA 水平,推动行业注重实用价值。
Codex 的野心,MCP 和 Skill 的下一步
作者密集使用Codex App等Agent应用,发现顶尖Agent收敛到相同界面布局。Codex野心大,要处理多格式文件、支持专业工作流。MCP和Skill未解决用户二次编辑问题,插件机制或是出路,Codex已有原始插件市场。
国产模型开源封神,谷歌Genie3紧急开源?蚂蚁AGI撕开世界模型闭源防线
蚂蚁灵波发布开源SOTA级世界模型LingBot - World,全面对标谷歌Genie 3,部分性能指标超越。它有高保真、长视频生成等优势,还能解决具身智能痛点,发布后引发海外关注,促使Genie将开源。
Anthropic 发布 AI Agent 上下文工程指南
今年6月Andrej Karpathy提出用「上下文工程」取代「提示词工程」。Anthropic发布工程博客呼应此观点,指出构建AI应用重心转向策划上下文。文章详述上下文工程重要性、有效上下文剖析、检索及长时任务应对技术等。
Yann LeCun非生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点
2026年Yann LeCun团队3篇论文展示基于JEPA框架的非生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为非生成式世界模型提供技术路线。
33岁稚晖君,上市公司董事长!
11月25日,上纬新材公告选举彭志辉(稚晖君)为董事长。智元机器人于2025年7 - 11月完成对上纬新材收购,成本约21亿。上纬提示股价风险,业务仍在开发未量产盈利,主营未变。
Sora 2 中国首测?Open AI 这次真成了!
OpenAI提前发布Sora 2模型,可克隆音色,支持多语言。还推出似AI版抖音的社交APP,免费生成视频。测试显示,它有世界知识,能多参生成、自动切镜头,在多方面表现出色,但版权限制严,部分一致性待提升。
Qwen全面升级非思考模型,3B激活、256K长文、性能直逼GPT-4o
Qwen全新非思考模型Qwen3-30B-A3B-Instruct-2507上线,仅激活3B参数,性能媲美顶尖闭源模型。相比前代,推理、对齐和长文本处理能力大幅提升,在通用能力上也全面进步,适合复杂人机交互应用。
JFM | 西北工业大学杨忠鑫、张伟伟等:数据驱动的特定且可泛化的湍流封闭知识发现
本文基于高精度数据结合符号回归等方法重建混合长理论,提出解决泛化性问题的策略。通过槽道等基本流动获普适公式,用于封闭求解RANS方程,在工程附着流中提升精度,为飞行器摩阻预测提供新工具。