「AI 图像生成」共找到 10823 篇相关文章
刚刚,李飞飞空间智能新成果震撼问世!3D世界生成进入「无限探索」时代
斯坦福大学教授李飞飞创业公司 World Labs 发布限量开放测试预览版空间智能模型 Marble。输入单张图片或文本提示,它就能生成可无限探索的 3D 世界,与谷歌 Genie 有显著区别,还支持导出高斯点云等。
从 Computer Use到 Datacenter Use:如何让 AI Agent 像调用函数一样驱动数据中心?
本文整理自 QCon 2026 北京站演讲,探讨如何让 AI Agent 驱动数据中心。指出 Agent 发展有 Multi - Agent 和 Datacenter Use 趋势,介绍 AKernel 基础设施,包括架构、技术支柱、部署方式等,还提及其实践落地与未来演进。
Karpathy氛围编程最新指南!三层AI编程结构:顺境Cursor,逆境Claude,绝境GPT-5 Pro
大神Karpathy发布全新Vibe Coding指南,总结出AI编程三层结构:Cursor负责自动补全与小修改,Claude Code/Codex实现大功能块,GPT - 5 Pro解决难题。该指南是对Vibe Coding概念的升级。
免费开源、可本地部署的AI私人助理Clawdbot,保姆级搭建教程来了
本文提供免费开源、可本地部署的AI私人助理Clawdbot的搭建教程。它能在多平台运行、连接工具和技能。教程涵盖创建虚拟机、安装Node.js和Clawdbot、设置连接等步骤,还介绍技能扩展和VPS运行方案。
ICLR 2026|滑铁卢大学联合可灵提出UniVideo:统一视频理解、生成、编辑多模态
滑铁卢大学与快手可灵团队提出 UniVideo,是支持视频理解、生成与编辑的多模态模型。它采用双流架构,结合 MLLM 与 MM - DiT 能力,统一 10 个多模态任务,在多项基准超现有方法,代码已开源。
规范驱动开发落地经验谈:为什么 AI 编程的关键不在模型,而在协作方式
文章指出 AI 编程关键在协作方式,规范驱动开发(SDD)应运而生。它有诸多价值,但落地面临工具短板等挑战。企业可将其适配现有工作流,长远看需将规范作为动态指南,实现智能体编排开发的质量转变。
干掉 90% 的 BI 工程师:自动生成 SQL、洞察、预测,连图表都帮你画好
介绍了基于LLM和RAG的结构化数据问答系统,它能将查询转化为SQL语句执行,生成数据图表及分析。其看板用法新颖,可进一步分析、预测,免去大部分BI工作,对非技术分析人员友好。
硅谷今夜学中文!Cursor被曝「套壳」国产,AI顶级人才全是华人
新智元报道,硅谷AI圈现神奇现象,不会中文难进核心团队。海外模型频“偷师”国内开源模型,如Cursor的Composer思考时说中文,Windsurf用GLM-4.6微调。国内开源模型量大管饱、性能好还便宜,能力稳居第一梯队。
多稿合并:从手动比稿到一键 Skill
AI 翻译或写作常生成多版本稿件,各有亮点但不完美。手动合并耗力,可让 AI 完成。还能将流程做成 Claude 的 Skill,介绍了两种创建方式及适用场景,给出多稿合并 Skill 示例。
当Gemini 3刷屏时,这款AI已开始救命了:原子级攻克「不可成药」靶点
全网关注Gemini 3时,Chai-2已开启生物学界「AlphaFold时刻」。它能原子级精准设计出可进临床的抗体药,攻克「不可成药」靶点,让很多难治疾病看到新药希望,AI造药开始起飞。