端到端生成」共找到 4157 篇相关文章

算法论文8

OpenVision 2:大道至简的生成式预训练视觉编码器

多模态大模型浪潮中,视觉模块是关键。此前OpenVision训练管线复杂,成本高。研究者提出OpenVision 2,移除文本编码器与对比学习,引入随机丢弃视觉token技巧,性能佳且效率高,挑战了对比学习范式。

机器之心
推荐文章8

张小珺对话OpenAI姚顺雨:生成新世界的系统

OpenAI研究员姚顺雨在播客访谈中分享诸多新颖观点。他认为创业公司机会在设计新交互方式,未来或产生超越ChatGPT的超级应用;还指出语言是实现泛化的工具,强化学习有泛化趋势,智能边界由不同超级应用共同定义。

Founder Park
推荐文章7

从BM25Multi-Vector:6种Embedding演进路线

文章介绍6种Embedding演进路线,包括Sparse、Dense等,分析其特点、痛点、效果和案例,还给出选型建议,如关键词匹配选Sparse,长文本定位选Multi - Vector,也提及方案选择步骤。

CourseAI
推荐文章7

搜索领域的下一个重大转变:从产品基础设施

Lightspeed投资人称搜索正从人类产品转变为AI基础设施,像云计算支撑互联网,搜索将为AI提供信息。各公司集成搜索进展不同,还分析了搜索成基础设施带来的变化及新机会。

Founder Park
产品应用7

从扭秧歌跑半马:机器人离「iPhone时刻」还有多远?

过去半年,机器人表演把人们认知拉进现实。当下具身智能赛道玩家关注缩短探索周期、降低成本。地瓜机器人发布 RDK S100 套件,其有独特设计和适配场景,还围绕开发者诉求提供支持,跑通多种场景。

机器之心
产品应用8

The Batch:827 | Claude 4 推动代码生成能力再升级

Anthropic 发布 Claude 4 Sonnet 和 Claude 4 Opus 模型,支持“推理模式”,能并行调用工具。还发布 Claude Code 编程智能体及 SDK。两款模型输入输出能力强,功能亮点多,性能表现佳,有多种使用渠道和定价。

DeeplearningAI
推荐文章7

200行python代码实现从Bigram模型LLM

本文从`babygpt_v1.py`出发,逐步加入self-attention机制、position嵌入等,实现完整GPT。介绍Transformer结构,讲解位置编码、单头自注意力等机制的代码实现,还阐述后续层的用途、参数调整及训练效果,最后提及模型优化方向。

阿里云开发者
产品应用8

日志采集效能跃迁:iLogtail LoongCollector 的全面升级

2025年,iLogtail正式升级为LoongCollector,实现日志采集和处理领域的新跨越。它架构升级,有多样Pipeline形态,性能提升,稳定性和隔离性增强,还具备网络探测、无缝迁移等优势,将带来可观测数据全栈采集新体验。

阿里云开发者
新闻资讯7

Node.js 拟内置虚拟文件系统,AI 生成代码引争议

Node.js 技术指导委员会成员 Matteo Collina 提议在 Node.js 核心新增 `node:vfs` 模块引入原生级虚拟文件系统,引发关注。功能可解决常见工作流程难题,已获部分开发者支持,但因用 AI 开发引争议。

InfoQ
新闻资讯8

从「自我进化」「DAA」,百度给出 Agent 时代系统答案

2026 年 AI 行业发展微妙,模型能力增强但转化为生产力的企业不多。Create 2026 上百度给出两层答案,构建系统能力,提出 DAA 度量 AI。这是过去三年判断的收束,将非共识整合成面向 Agent 时代的方法论。

AI前线