「AI视频大模型」共找到 13822 篇相关文章

开源动态7

登顶AndroidWorld开源榜首!可以操作手机的移动端AI Agent。

Minitap开源的手机Agent登顶AndroidWorld开源榜首,亮点是能操控安卓与iOS模拟器。用户用自然语言就能完成复杂任务,还具备跨平台控制、全场景交互等特点,项目可快速部署。

开源AI项目落地
新闻资讯7

AI消灭感冒被提上日程,Anthropic和OpenAI罕见联手

全球支付巨头 Stripe 投资 5 亿美元建立非营利组织 Intercept,目标是解决呼吸道感染问题。Anthropic、OpenAI 等机构和个人也参与支持。Intercept 从广谱预防药物和空气净化杀菌技术两方面着手,科技公司也将提供技术助力。

DeepTech深科技
开源动态7

这个开源项目把视频处理与投稿接成一条流水线

Y2A-Auto是面向YouTube、AcFun和bilibili的自动化处理工具,将下载、识别、翻译等操作集成到Web管理后台。用户可手动或自动处理,支持多平台投稿,有多种功能和灵活配置,适合持续处理授权内容的用户。

GitHubStore
新闻资讯7

OpenAI的首款硬件:是AI耳机,今年销量要冲5000万

数码博主透露OpenAI「To - go」硬件项目细节,其首款硬件是取代AirPods的音频产品「Sweetpea」,预计9月发布,首年预估出货4000 - 5000万部,由苹果前首席设计官团队操刀。

机器之心
新闻资讯8

Nature发布Delphi-2M模型,提前20年预测你得什么病

2025年9月17日《自然》发表研究成果,欧洲、德国和丹麦科学家改造GPT架构,推出Delphi - 2M模型。它能预测1258种疾病及死亡风险,依据过往病史等提供风险概率,虽有局限但潜力大。

AIGC开放社区
算法论文8

上下文工程(Context Engineering)综述:大模型的下一个前沿

文章提出“上下文工程”学科,通过整合1400余篇论文构建“基础组件 - 系统实现”框架。它将上下文定义为动态结构化信息集合,揭示LLMs理解强于生成的矛盾,为AI研究指明方向。

深度学习自然语言处理
推荐文章7

AI 会生成 PPT 之后,Runtime 决定了它能做多好

作者回顾PPT Agent发展,指出存在Agent理解操作文档及AI生成PPT表达单一的问题。提出Artifact Runtime概念,它让PPT可被持续操作,还能接管重复决策,但不能替代专业判断。

phodal
新闻资讯8

OpenAI史上最快模型降临,每秒1000Token!代码从此「炸出来」

OpenAI发布GPT-5.3-Codex-Spark,它是专为实时编程设计的超高速模型,生成速度超每秒1000个token,联手Cerebras硬件,重写底座提升性能,在多项测试表现强,ChatGPT Pro用户可尝鲜。

新智元
推荐文章8

从Vibe Coding到Harness—— 一套大仓AI工程化实战

这是腾讯后端微服务与前端微应用大仓的 Harness 实战分享。介绍了 TAB 工程背景、Harness 组成部分,阐述阶段划分、Agent 演进等,还提及人工关卡、门禁脚本等要点,总结了经验与限制。

腾讯技术工程
新闻资讯7

突发!Anthropic “封杀”中国控股公司,禁止其使用Claude等AI服务

9月5日,Anthropic宣布禁止多数股权由中国资本持有的集团或子公司使用Claude。政策调整涉及多种中国背景企业,也适用于美“对手国家”,还意在遏制中方获取先进AI技术,引发行业关注。

InfoQ