「可控视频生成」共找到 2750 篇相关文章
OpenAI放大招!核心API支持MCP,一夜改变智能体开发
今天凌晨,OpenAI全资收购io消息吸睛,还悄悄宣布核心API——Responses API支持MCP服务。这简化智能体开发,还能集中管理工具、保障安全。此外,Responses API的图像生成等工具也有更新,并引入新功能。
重磅并购!车规MCU赛道迎洗牌
4月28日,矽力杰发起的并购基金完成对云途半导体的控股收购。矽力杰专注模拟芯片,云途基于Arm架构。二者技术互补,此次收购补齐矽力杰短板,正值国产替代关键期,将推动车规芯片自主可控。
阿里云海外重磅发布 Qwen Cloud
5月26日,阿里云在新加坡面向全球发布Qwen Cloud。它为AI Agent而生,有Skills、CLI、Website三入口架构,一站式接入模型,覆盖六大模态,成本可控,开放多元生态,还启动黑客松活动。
AI“氛围编程”威胁开源,维护者面临危机
开源维护者正加速关闭外部贡献,因AI生成贡献量大质低。研究显示“氛围编程”会造成负反馈循环,降低软件可用性和质量。平台激励加剧问题,虽有应对策略但效果不佳。
谷歌nano banana正式上线:单图成本不到3毛钱,比OpenAI便宜95%
昨晚谷歌图像生成与编辑模型nano banana上线,正式名gemini - 2.5 - flash - image - preview。它有强大能力,成本低,有多种玩法,上线后测试火爆,在多个榜单成绩优异。
啊?豆包居然也开始卷AI编程了?
作者体验发现豆包更新了“应用创造1.0”标识的AI编程功能。该功能不仅能生成代码,还能可视化修改网页结果,用户操作轻松,降低了AI编程门槛,体验远超其他同类产品。
何恺明首个语言模型:105M参数,不走GPT自回归老路
何恺明团队推出全新连续扩散语言模型ELF,不走GPT自回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型。
英伟达再破世界纪录,每秒1000 token!刚刚,全球最快Llama 4诞生
英伟达用Blackwell创下AI推理新纪录,单节点8颗GPU实现Llama 4 Maverick模型每秒单用户生成1000个token。这得益于技术组合拳,如用TensorRT - LLM优化、应用FP8格式等,满足了低延迟需求。
AI精准编辑门槛大降:开源框架提升编辑一致性,即插即用
近日,中山大学、香港中文大学等团队发布研究成果ProEdit。它通过对注意力机制和初始噪声潜在分布处理,实现高精度图像与视频编辑,无需训练、即插即用,解决编辑效果与一致性平衡难题。
99%的人都不知道:MCP 必须在 Claude Code 外面装
作者分享飞书MCP安装经验,指出MCP要在Claude Code外安装,介绍用Cursor生成安装命令、验证安装、删除服务等技巧,还整理《MCP安装指令文档》,复制粘贴就能用。