多模态代码生成」共找到 4163 篇相关文章

推荐文章7

从零开始200行python代码实现LLM

文章从传统思路出发,用Python实现极简大语言模型,介绍从零基础到Bigram模型的过程,包括词汇表、模型训练推理等内容,还讲解了PyTorch基础,最后实现pytorch版Bigram模型,后续将实现完整GPT。

阿里云开发者
新闻资讯8

一个月重写三次代码库、三个月就换套写法!吴恩达:AI创业拼的是速度,代码不重要

吴恩达在 Y Combinator 演讲分享创业心得,指出执行速度是创业成败关键,创业者最大机会在应用层,介绍提速方法,还回应 AGI 炒作、token 成本等问题。

AI前线
推荐文章8

一个月重写三次代码库、三个月就换套写法!吴恩达:AI创业拼的是速度,代码不重要

吴恩达在 Y Combinator 演讲分享创业心得,指出 AI 创业成败关键在执行速度,最大机会在应用层,还介绍提速方法,如想法具体、用 AI 编程工具等,问答中回应 AGI 炒作等问题。

InfoQ
开源动态8

多模态Qwen3-VL-Embedding开源&技术剖析

互联网内容多元,传统文本搜索引擎应对跨模态需求力不从心。阿里开源Qwen3-VL系列两大模型,Qwen3-VL-Embedding负责“海选”,Qwen3-VL-Reranker负责“决赛”,技术亮点多,实验表现优异。

PaperAgent
新闻资讯8

Karpathy:写了20年代码,现在像作弊

Karpathy曾造词“vibe coding”,一年后弃用。他开源autoresearch项目,让AI Agent自主跑实验,自己不写代码。他还展示家庭监控分析系统也由Agent完成。他提出“agentic engineering”,认为工具虽变,但深度技术专长更重要。

新智元
7

新的基础设施即代码工具“formae”瞄准了 Terraform

平台工程实验室于2025年10月22日推出开源基础设施即代码平台formae,试图解决现有工具的根本性限制。它有两种操作模式,能自动发现和编码现有基础设施,使用PKL语言,还面临成熟工具竞争。

InfoQ
新闻资讯7

糟糕,大佬45年前论文,被判AI生成

随着AIGC增多,AI内容检测需求迫切,但表现远不及预期。如作家Adam Kay、教授Devi Sridhar等多人的作品被误判,原因或是AI用人类内容训练,使判断边界模糊。

机器之心
算法论文8

MoCa:首个大规模双向多模态表征模型

为解决VLM用于嵌入的痛点,中国人民大学等机构研究者提出MoCa框架,可将单向注意力VLM训练成双向多模态编码器。它分两阶段,实验效果好,未来可拓展模态、提升多语言适应等。

PaperAgent
开源动态8

港大nanobot4,000行代码复刻Clawdbot

港大nanobot用4000行代码复刻Clawdbot,解决AI从‘被动回答’到‘主动服务’问题。它有核心架构Agent Loop,三大主动触发机制,模块化设计,还坚持少即是多原则,让AI成自动化助手。

CourseAI
产品应用7

全球功能最全的视频生成模型来了

阿里发布新一代通义万相2.6系列模型,是全球功能最全的视频生成模型,覆盖文生视频等多种模式。它在视频创作和文生图方面能力提升,虽有小瑕疵,但日常短视频和二创已可用。

量子位