「网页应用生成」共找到 4166 篇相关文章
超越纯视觉模型!不改VLM标准架构,实现像素级深度预测
Meta开源DepthLM,首证视觉语言模型不改架构,也能媲美纯视觉模型的3D理解能力。它通过视觉提示等策略,解锁VLM多任务处理潜力,为自动驾驶等领域带来前景。
Seedream 4.0大战Nano Banana、GPT-4o?EdiVal-Agent 终结图像编辑评测
在AIGC下一阶段,图像编辑成检验多模态模型关键场景。研究者提出EdiVal - Agent评估框架,能自动化生成指令并多维度评估编辑结果,其评估与人类判断一致性高,还对比了13个模型的多轮编辑表现。
黄仁勋不信泡沫,OpenAI需要“印钞机”
文章围绕OpenAI与AMD、英伟达等的“股权换订单”合作展开,分析AI行业泡沫问题。指出OpenAI收入与投入落差大引发担忧,但也有人认为这次泡沫或不同。还提及科技公司资本支出增长,AI发展空间大。
X上63万人围观的Traning-Free GRPO:把GRPO搬进上下文空间学习
年初 DeepSeek - R1带火大模型强化学习,GRPO成常见RL算法,但训练成本高。腾讯优图论文提出Training - Free GRPO,将GRPO训练范式迁移到上下文学习,成本低、泛化好,已开源。
AI 时代,编程语言选型更难也更重要:Go、Rust、Python、TypeScript 谁该上场?
文章围绕AI时代编程语言选型展开,引述Armin Ronacher观点,对比Go、Rust、Python、TypeScript,指出各语言适用场景,还提及AI编程工具影响及创业公司语言选择建议,探讨错误处理和创业体会。
超越纯视觉模型!不改VLM标准架构,实现像素级深度预测
Meta开源DepthLM,首证视觉语言模型不改架构就能媲美纯视觉模型的3D理解能力。通过视觉提示等创新策略,它精准完成像素级深度估计等任务,为多领域带来前景。
专访 AI 游戏创业者张昊阳:如何用《麦琪的花园》定义下一代沙盒范式
AutoGame创始人张昊阳离开腾讯后,带领团队打造AI游戏《麦琪的花园》,登上Steam新品榜Top50。他介绍了创业经历、产品玩法、团队分工等,还探讨AI对游戏行业的变革,认为AI游戏将带来行业范式迁移。
RL 效率无损飙升 3 倍:厦大-Shopee-清华联合首创,将投机解码首次引入 RL,推理能力稳如初!
传统RLVR训练中,rollout阶段耗时成瓶颈。厦大 - Shopee - 清华联合团队提出SPEC - RL,将投机解码引入RL,训练提速2 - 3倍,避免重复生成,与主流算法兼容,在多项基准测试中性能稳定。
超越RAG,DRAG让LLM准确率飙升45.5%,问题越复杂能力越强
RAG技术虽能让LLM检索资料生成答案,但存在短板,听不懂话里有话。DRAG方法应运而生,有DRA和RSC两大法宝,经对比实验,它在多任务上领先,准确率大幅提升,计算开销小。
CAIR开源发布超声基座大模型EchoCare“聆音”,10余项医学任务性能登顶
2025年9月17日,CAIR开源发布超声基座大模型EchoCare“聆音”。它基于超450万张影像数据集训练,在10余项医学任务测试中表现卓越。首创结构化对比自监督学习框架,为AI医疗应用提供创新路径。