善意的混乱」共找到 10702 篇相关文章

产品应用8

当搜索遇见 AIGC:京东零售“千人千面”素材生成实践

在 AIGC 浪潮下,视觉生成技术重构电商生态。京东零售李岩介绍“千人千面”商品素材生成技术链路,包括关键模型及实现框架,还发布焕新版京点点平台并预告新能力,推动电商个性化变革。

InfoQ
产品应用8

南华期货 x TencentOS:如何实现CentOS操作系统“无感”切换?

2024年南华期货与腾讯合作,依托TencentOS Server完成200余套操作系统迁移,实现核心业务零事故切换。其分三阶段实施,TencentOS Server以无感迁移、稳定性强、利于生态协同等优势获选,迁移成效显著。

InfoQ
算法论文8

NeurIPS 2025|VFMTok: Visual Foundation Models驱动Tokenizer时代来临

传统视觉 Tokenizer 存在缺乏高层语义信息、冗余度高、表征混乱等问题。香港大学 CVMI Lab 和阶跃星辰 AIGC 团队提出 VFMTok,用预训练视觉基础模型构造视觉 Tokenizer,实验显示其性能优异。

机器之心
产品应用7

LangChain提出Agent工程化新分层(Agent harness)

LangChain获新融资后重新定位为Agent基础设施提供商,将Agent开发分三层:Framework、Runtime、Harness。Vtrivedy提出Agent Harness概念,强调构建关键是“个性化定制基座”。Agent开发工程化成熟度在提升。

AI工程化
算法论文8

LightMem用3招重新设计了LLM记忆,结果出乎意料

LLM在超长多轮对话中有上下文窗口有限、记忆系统昂贵痛点。LightMem借鉴人类记忆机制,用三招重新设计LLM记忆,实验显示其准确率超基线,还降低token使用量、API调用和运行时间。

PaperAgent
7

别让故障复盘流于形式:用AI挖掘每一次“跌倒”价值

文章指出传统故障复盘存在诸多问题,借助AI能力可解决专业性和深度问题。介绍了智能复盘Agent,包括其核心使命、目标用户、核心价值和解决方案,还阐述了核心技术架构、实现方式及评测机制等,最后给出实战案例。

阿里云开发者
开源动态7

OVI:统一音视频生成模型,声音与画面同步诞生

音视频生成领域以往多阶段架构易致音画不同步等问题。耶鲁大学团队提出 OVI 统一范式,采用双塔 DiT 架构与分块式跨模态融合机制,实现音画同步生成,不过目前有计算开销大、音频有局限等问题。

带你学AI
推荐文章8

软件正在吞噬劳动力:直接取代人类,捕获前所未有经济价值

a16z 普通合伙人 Alex Rampell 演讲指出,软件正从辅助人类转向直接取代劳动。过去软件是将文件柜数字化,如今正从记录工具变为任务执行者,这将催生新商业模式,捕获巨大经济价值。

AI寒武纪
产品应用8

AI改造出行体验:滴滴试验能否开启行业范式转变?

滴滴近日面向公众内测上线出行AI助手小滴,颠覆传统打车模式。它能精准理解需求,提供个性化方案,还可进行时空推理和订单规划。滴滴用工程打法攻克难题,还上线MCP服务助开发者定制助手。

新智元
算法论文8

DeepMind率先提出CoF:视频模型有自己思维链

DeepMind在Veo 3论文中提出帧链CoF概念,类比语言模型CoT,让视频模型能时空推理。实验显示Veo 3有通用视觉理解能力,能零样本解决视觉任务,未来通用视频模型或取代专用模型。

量子位