「大模型编程」共找到 9841 篇相关文章

新闻资讯7

FriendliAI获2000万美元,以加速AI模型推理工作负载

专注AI推理的初创平台FriendliAI获2000万美元种子扩展轮融资,资金用于加速平台开发。其专有推理优化技术可降低模型运行成本和能耗,能为用户省90%的GPU成本,合作客户广泛。

AIGC开放社区
算法论文8

不再止步于自然语言!PhiZero让世界模型学会「物理语言」

PhiZero由中科院自动化所团队研发,探索让AI读懂真实世界运动、交互与变化的“物理语言”。它构建Reason - then - Render框架,经大量数据训练,在多基准测试中表现领先,为AI理解物理世界开辟新通道。

机器之心
产品应用7

本地可运行的高质量的文本转语音模型

介绍Kyutai的Pocket TTS,一款轻量级文本转语音应用,可在CPU高效运行,模型小且低延迟,支持Python API和CLI,能语音克隆,还可在浏览器试用,目前仅支持英语,也有社区浏览器端实现。

GitHubStore
算法论文7

PolyVivid实现多主体视频定制,身份一致性超越现有模型

现有视频生成模型在多主体定制中难保持身份一致与自然交互,上交和腾讯提出PolyVivid框架解决此问题。它在多方面优于现有方法,还介绍技术原理、演示效果,证明其在多领域有实用价值。

带你学AI
新闻资讯8

DeepMind 发布超真实世界模型 Genie 3,AGI 向前一步

谷歌旗下DeepMind发布通用型世界模型Genie 3,可通过文本提示生成动态世界并实时交互,其生成内容物理一致性达分钟级。它功能丰富,也受业内好评,但有行动空间有限等局限,对迈向AGI意义重大。

AI科技评论
开源动态8

Qwen开源版Banana来了!原生支持ControlNet

Qwen推出新图像编辑模型Qwen - Image - Edit - 2509,支持多图融合、增强单图一致性,原生支持ControlNet。还开源端到端全模态模型Qwen3 - omni,性能优异,功能丰富。

量子位
新闻资讯8

NVIDIA团队让编程Agent接管真实机器人实验,成功率达99%

NVIDIA GEAR 实验室负责人介绍 ENPIRE 项目,首次在机器人硬件实现自动化研究。让 8 个 Codex Agent 驱动闭环,完成高精度任务,成功率 99%。项目计划开源,还提出 MRU 与 MTU 指标。

机器之心
开源动态8

Github 4.1k star,SuperSonic AI×BI 大厂震撼开源

SuperSonic 是腾讯音乐开源的下一代 AI+BI 平台,融合 Chat BI 与 Headless BI 两种范式。它解决了传统 BI 工具复杂、数据口径不统一等痛点,有丰富功能和技术优势,适用于多业务场景,开源优势明显。

小华同学ai
算法论文8

AI精准编辑门槛大降:开源框架提升编辑一致性,即插即用

近日,中山大学、香港中文大学等团队发布研究成果ProEdit。它通过对注意力机制和初始噪声潜在分布处理,实现高精度图像与视频编辑,无需训练、即插即用,解决编辑效果与一致性平衡难题。

量子位
新闻资讯7

Andrej Karpathy:一场里氏 9 级的大地震正在重塑整个编程行业

文章围绕AI在编程领域的应用展开,作者与大师交流AI Coding方式,后提及Andrej Karpathy观点,指出编程行业正被重构,程序员需掌握新抽象层,应对不稳定智能系统。

MacTalk