「多模态输出」共找到 1196 篇相关文章
深谋商业化一骑绝尘!人形机器人中标国网电力,大载重eVTOL即将首飞
深谋科技在今年世界人工智能大会上大放异彩,其融合多模态感知检测的人形机器人中标国网河北电力项目,相关技术将应用于关键研究和装置研制。此外,其大载重eVTOL曜眸MX150E无人机即将首飞量产,有望成低空经济出海冠军。
让AI创作不千篇一律,提示词随机插词汇就行
最新研究发现,在AI开写前由人类提供开头或随机插入词汇,写作效果会更多样,AI写作同质化或因“启动条件”问题。研究创建三类同质化评价指标,还发现向系统提示注入随机词汇可提升模型输出多样性。
Agent 自我改进的六条路
文章梳理了让 AI Agent 不重新训练就能变强的六种机制,包括输出自审、持久记忆、进化搜索、对抗训练、自我修改和编排自优化,介绍了各机制代表项目及成果,指出 AI 学习正从训练溢出到部署阶段。
斯坦福大模型推理课免费了,谷歌推理团队创始人主讲
谷歌DeepMind推理负责人Denny Zhou在斯坦福大学CS25讲“LLM推理”课。大模型推理是给出答案前的中间思考步骤,能让复杂问题可解、提升答案准确性。还介绍了让模型输出推理答案的方法及提升推理能力要点。
那个刷爆全网的提示词技巧,吴恩达刚官宣:早就过时了!重磅发布2026最新提示词大师课
吴恩达发布《2026提示词工程大师课》,指出过去流行的提示词技巧已过时。课程介绍了成为AI高阶玩家的方法,如给足上下文、引导AI给出真实反馈、用渐进式大纲写作等,还提及AI知识获取、搜索及多模态能力等内容。
理想的眼镜,和李想的眼界
今年11月,李想称要让理想成具身智能领域最佳企业。一周后,理想发布AI眼镜Livis。Livis解决了轻便、续航与性能的矛盾,还利用造车积累实现资产复用。理想推它是因AI眼镜潜力大,能输出跨场景AI能力。
GPT-5.6攻克25年量子信息难题,人类学者连夜「像素级」洗稿发论文
7月23日,量子信息领域一道悬了25年的难题出现两份独立证明,一份由GPT - 5.6 Sol生成,另一份人类署名论文被质疑与GPT - 5.6 Sol输出相似且无AI使用声明。GPT - 5.6 Sol半月内已在多学科产出证明,引发学术署名规则讨论。
Life of a Token:像调试代码一样看懂大模型如何生成 Token
文章类比 Chrome 的 Life of a Pixel,追踪 LLM 里 token 从输入到输出的全程。以 GPT - 2 Small 为例,详细讲解其管线各阶段,如 Tokenization、Embedding 等,还介绍了残差流、KV Cache 等概念及 GPU 性能瓶颈和优化方法。
不是「电商 AI」,而是「AI 电商」
GenAI时代,AI与电商消费结合成趋势,“值得买科技”提出“全面AI战略”,发布火眼AIUC引擎等4个作品。其海纳MCP Server可输出消费服务能力,推动AI生态建设。还落地什么值得买Gen2和张大妈Agent等应用。
将 AI 注入 Java 应用程序
文章围绕将 AI 注入 Java 应用程序展开,以宇宙飞船租赁应用的聊天机器人为例,介绍如何用 LangChain4j 和 Quarkus 等 Java 框架与大语言模型(LLM)交互,还提及流式响应、结构化输出等功能及相关概念。