「图构建」共找到 2180 篇相关文章
京东JoyInside戴文军:AI的终极形态不是聊天,是融入你家每一件物品丨AIGC2026
京东科技JoyInside业务负责人戴文军在AIGC2026峰会上提出,AI终极形态是融入万物,硬件将主动感知、理解需求。JoyInside以附身智能给硬件植入AI大脑,京东构建全链路布局推动AI走进家庭。
我把Agent拉进群聊,它竟然开始带队干活?全球首个AI社交通用平台来了!
全球首个AI社交通用平台「Teamily AI」上线,AI Agent可参与社交互动。它不挑内容形态,能进群协作,还能零部署构建专属OpenClaw。其有三层架构,团队实力强,或改变人类协作方式。
腾讯AngelSlim重磅升级!面向全模态的大模型压缩算法工具包,推理速度飙升 1.8倍!
近年来,推理阶段的成本等因素制约大模型规模化应用。腾讯混元升级的 AngelSlim 围绕 Eagle3 投机采样训练范式构建系统化实现,支持多模态场景,最高可实现 1.9× 推理加速,还具备多亮点。
以前写文排版60分钟,现在 Claude Code 3分钟
作者分享AI写作系统,用AI梳理复杂逻辑生成配图,进行个性化排版、一键出稿。介绍必需工具如Obsidian、PicGo、Claude Code等,还提供具体配置教程、进阶玩法,如规范写作、生成逻辑图、定制风格。
HaluMem:让AI记忆系统的“幻觉”现形——首个面向记忆系统的操作级幻觉评测基准
过去一年,AI Agent的‘记忆能力’成热门话题,但AI记忆存在幻觉问题。为此发布操作级幻觉评估基准HaluMem,它能精准定位幻觉来源,评估主流记忆系统,为构建可靠记忆系统提供方向。
字节Seed团队发布循环语言模型Ouro,在预训练阶段直接「思考」,Bengio署名
现代LLM依赖显式文本生成训练“思考”,未充分挖掘预训练数据潜力。字节Seed团队联合多家机构推出循环语言模型Ouro,将推理能力构建到预训练阶段,实现参数效率提升,还降低了有害性。
IROS 2025 | 机器人衣物折叠新范式,NUS邵林团队用MetaFold解耦轨迹与动作
新加坡国立大学邵林团队提出MetaFold框架用于机器人衣物折叠。它创新分层架构,解耦任务规划与动作预测。构建开源数据集,经实验在多指标超现有方法,还验证了从仿真到现实的迁移能力。
超过GPT-image-1!大黑马Black Forest刚开源新模型,只用文本实现一键PS
今日凌晨,Black Forest开源文生图模型FLUX.1-Kontext开发者版本,功能类似PS,用自然语言就能一键P图。测试显示它超GPT-image-1,成最强开源文生图模型之一,还在架构、训练、工程层面做了优化。
3D指标超过Nano Banana Pro!浙大开源方案让AI在平面图像里进行立体编辑 | ACM MM'26
当前图像编辑模型处理三维状态常出错。浙江大学ReLER团队提出并开源PhyEdit,用显式3D几何preview指导图像编辑,还加入深度监督,构建数据集和评测基准,成绩超Nano Banana Pro,且GUI也开源。
Karpathy强推,大厂抢着「复古」命令行,Star数全都上千了
飞书、钉钉、企业微信接连推出 CLI,GitHub Star 数上千。CLI 是传统人机交互方式,契合大语言模型运作逻辑,国内外多家公司及项目推出相关工具,还给出为智能体构建 CLI 的设计模式。