功能优化」共找到 2685 篇相关文章

开源动态7

开源半自动化交互工具

Automat 目标是半自主玩各种游戏,是构建通用计算机交互环境首步。目前功能限于键盘宏录制和回放,不稳定。它是进行中的项目,路线图有激进新功能。文中介绍下载、运行方法及项目地址。

GitHubStore
新闻资讯7

OpenAI版抖音要来了!Sora 2加持,只能发AI生成视频

OpenAI正为视频生成模型Sora 2推独立社交应用,形态似TikTok,内容须AI生成,不可上传外部媒体。有独特身份验证功能,已内部测试获积极反馈,将与Meta、Google、TikTok竞争。

AI寒武纪
新闻资讯8

这个世界越来越科幻了:OpenAI 发布 AI 超级助理 Plus,Gemini 发布有了真正的“思考力” 的机器人

OpenAI发布ChatGPT Pulse,它基于个人信息主动分析兴趣、梳理日程,预测需求并推送资讯或建议,像懂心思的私人助理。谷歌DeepMind推出Gemini Robotics 1.5,让机器人有自主‘思考’能力,其ER 1.5模型预览版上线。

宝玉AI
产品应用8

AI视频生成走向「演技生成」时代,生数科技Vidu全球发布Vidu Q2

9月25日,生数科技全球上线新一代图生视频大模型Vidu Q2,打破AI生成表情假、动作飘忽等问题,实现从“视频生成”到“演技生成”跨越,有AI演技生动、镜头语言丰富等亮点,已多端上线。

机器之心
算法论文8

OmniInsert:全新无掩码视频插入技术

基于扩散模型的视频插入技术发展快,但以往方法有局限。字节提出InsertPipe和OmniInsert,解决数据不足等难题。OmniInsert设计巧妙,还建立评测平台InsertBench,虽有小问题,但推理快,可加速优化

带你学AI
开源动态7

详解Github 35K+项目:打通200+数据源,构建企业级AI的数据统一入口,支持MCP【上篇】

文章实测开源的AI数据统一访问引擎MindsDB,介绍其架构、安装启动方法,展示跨多数据源统一查询、AI模型赋能数据查询等功能,还将在下篇介绍知识库与智能体特性。

AI大模型应用实践
产品应用7

GPT-5-Codex 一手实测

OpenAI推出新编程模型GPT - 5 Codex,Every团队实测显示其表现狂野。它能动态选思考时间,可在不同开发环境无缝切换,代码审查更优。但也存在对任务挑剔、环境设置麻烦等问题。

AGI Hunt
产品应用8

把抖音的研发管理搬到车企,跑得动吗?

飞书项目在深圳新品发布会推出整车研发解决方案,首次明确‘平台化’定位并公开产品架构。其方案覆盖架构整合等四场景,还进行技术升级,如轻应用、Project 4K 计划等,已获车企实践验证。

InfoQ
推荐文章7

如何让AI“看懂”网页?拆解 Browser-Use 的三大核心技术模块

传统Browser - Use难应对界面变化,大模型驱动下正迈向智能化。文章拆解其三大核心技术模块,介绍历史发展、核心功能,分析源码各模块,指出创新点与不足,还提及业界更好解决方案。

阿里云开发者
开源动态8

用短视频成本生成长视频,字节Seed新注意力机制让计算量降低85%

字节Seed与斯坦福等机构推出新模型,其新注意力机制MoC能让长视频生成计算量降低85%,质量不减且保持连贯性。团队将视频生成定义为上下文检索任务,提出MoC机制并阐述实现方法。

量子位