人在回路」共找到 8816 篇相关文章

开源动态8

Qwen新开源,把AI生图里的文字SOTA拉爆了

通义模型家族新开源图像生成模型Qwen - Image,是通义千问系列首个图像生成基础模型。实测其对提示词理解到位,文字渲染高保真。它具备复杂文本渲染、一致性图像编辑能力,多基准测试达SOTA。

量子位
产品应用8

Qwen3-Embedding 全揭秘:从技术到服务,打造高效AI产品的关键路径

文章全面揭秘 Qwen3-Embedding,介绍其核心原理、优势、应用场景。还给出 PAI 和百炼平台的使用方法,含部署、推理、微调等。通过对比实验,凸显其低延迟、低成本特点,未来将成语义理解核心设施。

阿里云开发者
开源动态8

DeepSeek R2没来,Kimi K2来了,VLLM,SGLang首发支持

Moonshot AI发布Kimi K2大语言模型,采用混合专家架构,总参数量达1万亿。其有多项技术创新,多个基准测试表现突出。发布两版本,用修改版MIT协议开源,vLLM、SGlang首发支持,已上线多服务。

AI工程化
新闻资讯7

Meta 148亿美元收购的28岁华裔CEO谈管理哲学,其或将成为硅谷的下一个「主角」

28岁华裔CEO Alexandr Wang将Scale AI卖给Meta获143亿美元,分享独特管理哲学,强调雇佣乎之、注重质量。交易引发才收购讨论,也使Scale失中立地位,其能否胜任Meta AI领导存争议。

AGI Hunt
产品应用7

吉卜力风「手游」爆火,可灵+Midjourney生成的!教程已出,支持复刻

吉卜力风格“手游”Reddit和推特爆火,它由AI制作,创作者用可灵AI、Midjourney结合文字提示实现效果,公开教程支持复刻。还介绍了制作方法及提示词示例,可灵AI发展势头也很猛。

量子位
产品应用7

AI无师自通,搞定所有家务!π0.5突破泛化极限,UC伯克利系出品

具身智能最大挑战是泛化能力,美国具身智能公司Physical Intelligence推出π0.5 VLA模型,通过异构任务协同训练实现泛化,可全新家中执行各种家务,虽有不足但向广泛泛化物理智能迈进。

新智元
开源动态8

告别昂贵工标注,英伟达全自动视频理解助力小模型逆袭顶级大模型

麻省理工、英伟达等推出FoundationMotion,它是全自动数据生成流水线,能解决运动数据稀缺难题。通过自动标注生成问答数据,让小模型经微调后运动理解上超越顶尖闭源模型,还介绍了其数据生成、问答设计等环节。

AIGC开放社区
新闻资讯7

Google 团队一年都没做出来的项目 Claude Code 一小时就把代码写出来了

Google首席工程师称团队一年没搞定的分布式Agent编排系统,Claude Code一小时生成代码。但后续有澄清,AI是基于一年探索成果生成‘玩具版本’。还分析了工作价值、瓶颈转移等,指出AI时代个体和小团队机会。

宝玉AI
算法论文8

传统训练效率很低?我们靠 “给模型降噪” 重新审视长上下文建模难题

文章指出长上下文模型处理长文本时易受噪声干扰,提出新评估指标IG分数和“上下文去噪训练(CDT)”方法。实验表明CDT优于现有策略,经其训练的开源模型长上下文任务中性能媲美GPT - 4o。

深度学习自然语言处理
算法论文8

让机器「不仅会想,还能准确去做」,VLA-R1把「推理+行动」带进真实世界

VLA-R1是“先推理、后执行”的VLA基础模型,结合链式思维监督与强化学习,优化推理和执行。它有两阶段训练、三类可验证奖励等创新点,经多层面测试效果好,多领域有应用前景。

机器之心