「AI视频大模型」共找到 13576 篇相关文章
谷歌杀疯了!Gemini CLI 重磅发布:对标 Cursor 的开源 AI 编程神器,个人完全免费
谷歌发布开源AI代理Gemini CLI,个人免费使用,用Gemini 2.5 Pro模型,有100万token上下文窗口,免费额度大。它是全能AI助手,功能强大,与VS Code无缝切换,GitHub项目已获9k+ Star。
Nature公开谷歌IMO金牌模型技术细节!核心团队仅10人,一年给AI编出8000万道数学题训练
谷歌DeepMind的IMO金牌模型AlphaProof技术细节公开。团队规模小,核心成员是IMO金牌得主。它把数学证明当游戏,用30亿参数模型和改进树搜索算法。训练难题靠自动形式化解决,赛场用TTRL突破,已开放使用。
8K Star!给所有 AI 编程工具加个智能调度中心,节省 20-40% Token!
AI编程圈火了个工具9Router,它是智能调度中心,能连接主流编程工具,自动路由到40多家AI提供商和100多个模型,自带RTK Token节省器,还有实用的三级降级机制,安装配置简单。
Pokee.ai 朱哲清:用 RL 搭建智能体的「骨骼与神经」| AI 产品十人谈
《AI 产品十人谈》对话 Pokee.ai 朱哲清,探讨强化学习与 Agent。朱哲清是强化学习信徒,曾带领 Meta 团队突围。他认为单靠预测难完成复杂任务,强化学习是超人类智能的关键,介绍了 Pokee.ai 产品优势及对通用 Agent 的看法。
ICLR 2026 | 异常需要定义!中传团队提出开放世界视频异常检测新范式
现有视频异常检测(VAD)方法泛化能力不足,无法适应开放世界需求。中传吴晓雨团队在ICLR 2026发表论文,提出LaGoVAD模型,联合建模视频与异常定义,解决样本密度下降等问题,实验显示泛化性强。
这个开源工具让AI理解你正在操作的任何界面,俩学生辍学开发的产品,功能超多。
Everywhere是两个学生辍学开发的开源交互式AI助手,能感知屏幕内容,在任意界面使用。它功能多、细节优,支持多场景,集成多种AI模型,使用简单,还提供个性化体验。
中国大模型如何破圈?开源不能太“独角戏”,也不是“上传 GitHub 就完事儿”
InfoQ 专访 Linux 基金会 Mark Collier,他分享对 AI 时代开源看法。指出开源是协作哲学,AI 开源与传统不同,倡导开放数据,认为商业限制不利生态,还谈及 Agent 与中国大模型开源等问题。
500万次围观,1X把「世界模型」真正用在了机器人NEO身上
1X公司为机器人NEO引入1X World Model,使其学会‘想象’。该模型借助视频预训练,不依赖大规模机器人数据和遥操作演示,能泛化到新场景。实验显示其在多任务上表现不错,但精细操作有挑战。
AI 时代的 MySQL 数据库运维解决方案
文章指出大模型与MySQL数据库运维结合能改变传统管理方式,提供完整的MySQL大模型运维系统构建路径,涵盖知识库建设、模型选择与调用策略设计、MCP Server开发及监控与优化闭环建立,可提升运维效率与准确性。
菲尔兹奖得主都栽了!Claude终结78年悬案,或成最重要AI数学成果
78年数学难题“六维球面上有无复结构”被哈佛数学家Levent Alpöge和Claude解决,他们绕开老路造出答案,还给出108页论证,数学家挑不出毛病。Alpöge在35天内三次用AI破难题,这次性质不同,是模型创造新对象。