「三维场景生成」共找到 3838 篇相关文章
像原始人一样和AI对话,费用可直接砍掉40%
开源项目‘caveman-compression’能帮使用ChatGPT API或其他大模型的用户省钱。原理是删废话留关键信息,有调用OpenAI和本地NLP两种压缩方式,不同场景省钱效果不同,还介绍了使用方法。
这个一年前出现的词让小白从 0 到月入 1 万美金成为现实
一年前,Andrej Karpathy 提出“Vibe Coding”,用户通过 AI 用自然语言提示生成代码,开发更快、构建更易,让小白也能写代码。如今它成现象级术语,未来还会持续发展。
奥特曼「红色警戒」5个月后,GPT Image 2屠榜,断层领先反杀谷歌
被Google按了半年头,OpenAI祭出反杀。GPT Image 2上线12小时登顶Arena文生图榜,领先Nano Banana 2达241分。它是从零重构的通用模型,具备原生思考能力,或改写图像生成赛道规则。
在Claude桌面版里用任意模型
现在Claude桌面版可使用任意模型,这是4月官方更新添加开发者模式带来的功能。文中介绍了操作方法,还称Claude桌面版是世界最好的AI客户端,覆盖多种使用场景,推荐大家使用。
西湖大学科研版NanoBanana开源!科研绘图从此自动化
西湖大学将科研版NanoBanana开源,其AutoFigure框架可自动化生成学术插图且能编辑,论文被ICLR 2026接收。该框架提出理性渲染范式,配套FigureBench基准测试集,表现超越人类预期。
我去,短短时间,狂揽27.4K星,Windows用户的春天,任务栏秒开Linux的「神器」来了,6的飞起
由 Cascadium 团队打造的 WSL Windows Toolbar Launcher,将 Linux 终端装进 Windows 任务栏。它有一触即发控制台、状态感知任务栏等功能,适用全栈开发、机器学习等场景,与同类项目相比优势明显。
图像、视频一模搞定!字节全能原生多模态本地可部署
字节开源原生多模态模型Lance,仅3B激活参数,40G显存就能跑,已登顶huggingface趋势榜。它能进行图像与视频的理解、生成、编辑等操作,在多个基准测试中表现优异,多项性能居首。
突发!OpenAI关停Sora
OpenAI彻底退出视频生成业务,关闭App和API,ChatGPT视频功能也没了,迪士尼10亿美元合同作废。Sora研究团队转向机器人方向。原因是Anthropic靠文字和代码实现高营收,而Sora营收不佳且消耗算力。
机械手成精了:能变形、能爬行、自己抓东西,全程无人操控
武汉大学高霄团队设计出可拆卸爬行机械手,能像普通机械手抓取物体,还能脱落爬行够取远处物品。其完成全套取物任务,未来有望用于工厂、救援、家庭等场景。
多模态开发革命!Gabber开源:图形化构建实时AI应用,效率提升10倍!
AI应用迈向多模态交互,传统开发方式周期长。开源项目Gabber是实时AI应用引擎,通过模块化与图形化简化开发,有诸多特性,还给出安装指南,适用于多种场景。