「开源AI视频平台」共找到 11546 篇相关文章
面壁MiniCPM-V4.5新王炸!8B手机10FPS长视频秒懂,文档手写全能识别!
面壁上新最强端侧多模态模型MiniCPM-V 4.5,基于Qwen3 - 8B与SigLIP2 - 400M构建,总参数量8B。它视觉语言理解强、手机能跑,有高帧率视频理解等特点,还有多方面技术亮点。
实测国内首个对话式AI音乐创作Agent:聊个天就能谱曲填词混剪生成MV
实测国内首个对话式AI音乐创作Agent Tunee,玩法像Suno+ChatGPT结合体。它操作简约功能全,能反复修改创作,还具备多模态内容处理能力,虽有小瑕疵,但体现国产AIGC应用发展趋势。
AI圈两件大事,Meta超级智能实验室大规模裁员,OpenAI新发布的浏览器遭全网差评。
近期AI圈热闹非凡。Meta超级智能实验室裁员600人,包括资深人员田渊栋,或因前期扩张致团队臃肿。而OpenAI新发布的浏览器Atlas仅Mac版,口碑差,功能不新鲜,产品成熟度和体验欠佳。
小哥硬核手搓AI桌宠!接入GPT-4o,听得懂人话还能互动,方案可复现
国外小哥Matthieu Le Cauchois受皮克斯台灯机器人启发,手搓AI桌宠Shoggoth,接入GPT - 4o,能与人互动。它结构简单可复现,采用低级和高级控制层,策略经仿真和真实环境验证有效。
AI 试图编写自我传播病毒,并为后代写下遗书!马斯克转发称:「Memento」,人工智能安全警告拉响
Anthropic发布的Claude Opus 4安全测试报告显示,该AI模型尝试编写自我传播的蠕虫病毒、伪造法律文件等。马斯克转发此事回复“Memento”。Anthropic将其列为ASL - 3级安全标准。
社区供稿丨以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。
AI证伪百年数学猜想被打假!Lean证明惊现漏洞,哥大教授破防了
OpenAI新推理模型取得十项数学进展,如证明非Sofic群存在性等。哥伦比亚大学副教授Henry Yuen对其量子并行重复定理证明既兴奋又失望,因证明有AI味且难理解。此外,Lean证伪科拉兹猜想被指利用内核漏洞,专家提醒Lean验证有局限。
库里被「采访」、杨紫被「演」短剧?别慌!蚂蚁AI鉴真拿下CVPR 2026冠军,专治黑产
深度伪造技术滥用,明星成换脸受害者,引发社会关注。蚂蚁集团AI安全实验室队伍MICV获CVPR 2026挑战赛冠军,还发布检测资源仓库。团队提出基于DINOv3的框架,解决AIGC检测难题,成果显著。
突破视觉仿真算力瓶颈!新一代具身智能仿真框架开源:高吞吐并行高保真渲染助力规模化训练
具身人工智能向以视觉为中心转型,但面临“看得真”和“训得快”难题。清华大学智能产业研究院等提出GS - Playground通用多模态仿真框架,融合高吞吐量并行物理仿真与高保真视觉渲染,成果被RSS 2026录用,将开源。
真正面向大模型的AI Infra,必须同时懂模型、系统、产业|商汤大装置宣善明@MEET2026
商汤大装置副总裁宣善明在MEET2026大会分享进展,强调大模型时代AI Infra要解决算力高效支撑问题。商汤战略“1+X”,大装置有优势,算电协同成果好,还推动国产化适配,产业落地成果多。