结构化生成」共找到 3021 篇相关文章

新闻资讯8

灵初智能陈源培:一个 00 后的机器人之梦

00 后陈源培是灵初智能联创,本科土木工程专业,大二因比赛对机器人感兴趣。他研究灵巧手,参与开源项目,灵初发布相关模型。他认为强化学习对灵巧手重要,还谈了模型、创业、落地等看法。

AI科技评论
算法论文8

给大模型装上「思维分段引擎」:浙大InftyThink解锁无限深度推理

如今大模型长上下文推理面临计算本高、推理易中断问题。浙大联合北大团队提出InftyThink新范式,将传统推理拆短片段并总结,突破推理长度限制,在多基座模型实验中表现优异。

量子位
产品应用8

训练MoE足足提速70%!华为只用了3招

Scaling Law下,MoE扩展模型能力法宝,但训练难题凸显。华为构建Adaptive Pipe & EDPB优化方案,还打造DeployMind仿真平台,解决了MoE训练中通信等待、负载不均等问题,使训练吞吐提升72.6%。

量子位
算法论文8

1/15本,实现AI水印新SOTA | 南洋理工大学&A*STAR

给AI生作品打水印行业共识,但传统方法有短板。南洋理工大学等机构研究人员提出局部鲁棒图像水印方法MaskMark,本仅为Meta模型WAM的1/15,在多任务中表现优异。

量子位
算法论文8

全新GPU高速互联设计,为大模型训练降本增效!北大/阶跃/曦智提出新一代高带宽域架构

随着大模型参数规模扩大,分布式训练关键路径,高带宽域设计对提升训练效率至关重要。现有HBD架构在可扩展性、本和容错能力等方面有局限,北大、阶跃、曦智团队提出InfiniteHBD架构解决问题。

量子位
产品应用7

一码难求的 Dia 浏览器,有了新进展

Dia 浏览器处于 Alpha 内测,需邀请码体验。测试反馈超预期,将打磨细节后发布。其优势是使用 AI 时能方便代入上下文信息,Chat 交互将主流,Arc 部分功能会融合进 Dia。

MacTalk
新闻资讯7

一个提示攻破所有模型,OpenAI谷歌无一幸免!

HiddenLayer研究发现一种「策略傀儡」提示,将危险指令伪装配置片段,配上角色扮演,能让ChatGPT等主流大模型开启「无限制模式」。此策略利用训练弱点,难修复且可扩展,厂商需智能监控。

新智元
开源动态7

ICML25 | 让耳朵「看见」方向!仅依靠360°全景视频,就能生3D空间音频

空间音频技术提升沉浸式体验关键,但现有技术未充分利用360°全景视频空间信息。OmniAudio研究可直接从360°视频生空间音频,相关代码和数据集已开源,虽有局限但前景好。

量子位
推荐文章7

RAG系统设计:揭秘语义搜索被低估的核心价值与KG驱动的架构选型策略

在AICon大会上,Hugging Face的尹一峰探讨基于语义搜索的RAG系统重要性,揭示其被低估原因,分析本质与作用,分享设计高效架构方法,还讨论KG驱动的RAG系统及范式选择。

AI前线
7

干货 | 算法岗校招经验分享+吐槽

作者分享算法岗校招经验与吐槽,涵盖个人背景、校招结果、面经。分析算法岗就业、算法与开发差异等情况,给出刷题、实习等方面建议,鼓励校招失利者别灰心。

海边的拾遗者