多业务场景」共找到 5648 篇相关文章

开源动态8

5.6K Star!原本付费现在开源!本地版“ElevenLabs”,视频翻译+声音克隆全免费!

今天给大家安利GitHub上开源神器Voice - Pro,它原本是商业付费软件,因团队无暇管理而开源。整合个先进语音模型,将视频处理流程打包成本地软件,免费且功能强大。

开源星探
新闻资讯7

GPT-5-Thinking新训练方法公开:让AI学会忏悔

OpenAI提出忏悔训练Confessions,让ChatGPT自己“坦白从宽”。在GPT - 5 - Thinking上实验有效,模型犯错后会坦白,且更诚实,不影响原任务表现。还介绍了训练方法、实验结果及局限性。

量子位
算法论文8

少量视角也能得到完整3D几何,即插即用的语义增强重建插件来了

现有神经隐式路线在样本稀疏时有跨视角对应不稳等问题。上海交通大学等团队提出SERES,将跨视角语义一致性作先验注入模型,以低成本解决歧义问题,在场景提升重建质量。

机器之心
新闻资讯7

14000人一夜失业!被裁白领挤爆TikTok,含泪直播失业全程

亚马逊本周宣布裁1.4万员工,占白领4%。被裁员工在TikTok、LinkedIn等平台记录失业瞬间,社交媒体成“失业直播间”。AI早已融入工作流,此次裁员或与AI投入有关,传统白领体系正被重新编码。

新智元
算法论文8

Adobe 新研究:不用再「喂」训练数据,VLM 靠和自己玩游戏变聪明

Adobe 等机构研究人员提出「Vision-Zero」,借鉴 AlphaGo 自迭代方式,设计让 VLM 自我学习框架。此框架以类似「谁是卧底」游戏训练,不依赖标注数据,在任务超越有标注的 SOTA 方法。

Founder Park
开源动态7

谷歌 Java 代理开发工具包新增 LangChain4j 集成

谷歌 Java 代理开发工具包(ADK)0.2.0 版本集成了 LangChain4j,显著扩展功能,让开发者能使用更模型。谷歌开发者 Guillaume Laforge 解释其优势,ADK 还引入系列增强提升性能。

InfoQ
产品应用8

数字生活的原生入口:蚂蚁集团发布AI眼镜全新技术框架gPass

日前,蚂蚁集团在2025 Inclusion・外滩大会发布全球首个智能眼镜可信连接技术框架gPass,具备“安全、交互、连接”能力,可解决AI眼镜生态痛点,已应用于部分品牌,未来将释放更潜能。

机器之心
开源动态8

腾讯混元发布并开源图像模型 2.1,支持原生 2K 生图

9月9日深夜,腾讯发布并开源混元生图模型“混元图像2.1”,支持原生2K高清生图,综合能力领先。它在方面升级,有诸亮点,评估显示效果优,还同步开源文本改写模型,能满足样视觉需求。

InfoQ
推荐文章7

下一代数据中心和高性能计算OIO光互连技术方案!

文章深度解析OIO芯片级光互连技术、挑战与未来。传统电I/O技术有性能受限等问题,OIO能解决大容量芯片I/O扇出难题,是光电融合终极形态。它虽面临量产挑战,但前景好,全球产业力量已集结。

芯师爷
产品应用8

谷歌Nano Banana全网刷屏,起底背后团队

谷歌开发者节目展示了Gemini 2.5 Flash Image模型,它能快速生成高质量图像、保持场景一致。文中起底背后团队成员,还介绍模型技术亮点、与Imagen对比及未来能力展望。

机器之心