「多模态智能」共找到 4139 篇相关文章
千丁数科魏振华:企业AI落地“六步法”|甲子引力
2025年12月3日,千丁数科COO兼首席科学家魏振华在甲子引力年终盛典上,结合龙湖数字化沉淀与实践,复盘企业AI落地。他提出“六步法”,并展示六大场景数据,为传统行业智能化转型提供参考。
摩尔线程新一代GPU架构10天后发布
2025年12月19 - 20日,摩尔线程首届MUSA开发者大会将在北京举行。大会聚焦国产算力,主论坛将发布新一代GPU架构,还有20+技术专场和1000㎡科技嘉年华,官网已开放报名。
Claude Code 豪气收购一家0收入前端公司:押注一位高中辍学创始人
当地时间12月2日,Anthropic宣布收购热门开发者工具初创公司Bun。此次收购标志其向开发者工具领域迈进,因Bun能解决智能体分发和运行效率问题,且被众多AI编程工具使用。
Agent 正在终结云计算“流水线”,Infra 必须学会“思考” | 专访无问芯穹夏立雪
InfoQ 专访无问芯穹联合创始人夏立雪,他分享了面向 Agent 的基础设施建设进展与经验,探讨从“处理”到“思考”的范式转变对基础设施的冲击,指出 Agent 规模化落地阻碍及解决办法,还谈及 Agentic Infra 等内容。
这款开源AI卡片笔记,让我果断卸载了Obsidian!
开源君推荐开源项目Blinko,它是自托管、AI驱动的个人笔记工具,主打“快”与“智能”,将RAG技术和LLM能力融入笔记管理,数据自主可控,适合注重数据安全和知识管理的人。
它来了!Context Engineering 2.0
SJTU、SII和GAIR新作《Context Engineering 2.0:The Context of Context Engineering》探讨上下文工程,回溯其30年历史,给出形式化定义,提出采集 - 管理 - 使用三维设计范式,还介绍了应用场景。
抖音SAIL团队联合港中文MMLab推出SAIL-Embedding:打通「视、文、音」的全模态嵌入
字节跳动抖音SAIL团队联合港中文MMLab提出SAIL - Embedding,专为大规模推荐场景设计,实现视、文、音统一表征,解决传统多模态模型局限,在抖音业务场景效果显著,相关技术报告已公开。
魔笔 AI Chat Builder:让 AI 对话秒变可交互界面
文章介绍阿里云魔笔AI Chat Builder,它能将AI对话变可交互界面。对比现有AI应用开发方式,阐述其综合优势,还介绍核心能力、搭建方法、多端发布等,未来将打磨能力并推新功能。
告别黑箱解释!首个潜变量自动解释框架 | CIKM'25
深度生成模型内部运作如「黑箱」,潜变量意义难捉摸。埃默里大学团队提出LatentExplainer框架,经数据扰动、智能提示、不确定性评估三步,为潜变量生成易懂解释,提升模型解释质量与可靠性。
Nature点赞!哈佛MIT最新作:AI科学家时代来了
哈佛MIT推出ToolUniverse,这一开源框架让AI用自然语言操作600+科学工具,解决了科学研究中AI智能体面临的工具格式不统一等问题,推动科研自动化升级,助力打造AI科学家。