「智能体数据合成」共找到 5430 篇相关文章
英伟达揭示RL Scaling魔力!训练步数翻倍=推理能力质变,小模型突破推理极限
学界对强化学习能否让模型学会新推理技能争论已久,过去研究多悲观。英伟达研究指出,问题源于任务在基础模型训练数据中过度呈现及训练步数不足。其ProRL框架提升训练步数,释放小模型潜力,还构建技术组合拳。
中英双语、29项第一、像素级理解:360 FG-CLIP2登顶全球最强图文跨模态模型
360推出FG-CLIP2图文跨模态VLM模型,在八大类任务、29项测试中超越Google与Meta。它能像素级看图,中英文皆强且已开源。其优势源于高质量数据集和先进训练方法,还在多业务落地并开放API。
一个上海AI独角兽爆发了
全球AI圈因MiniMax“发布周”沸腾。新模型MiniMax - M1被视为“性价比新王”,还有新视频、语音模型表现出色。其89年博士闫俊杰带队,在大模型研发上多次做非共识选择,现估值超30亿美元,还推出智能体产品。
超越Claude 3.5和o1!8B模型靠「分层投票+测试时训练」逆袭
近日MIT研究者发现测试时训练在大模型应对复杂推理问题时,能分解任务提升回答准确率。8B的lemma3模型经此方法,在ARC和BBH数据集上性能显著提升,超Claude 3.5等。但该策略部署效率低。
【博客转载】CUDA Vectorized Memory Access (文末送书)
文章展示如何用向量化内存访问提高CUDA函数有效内存带宽,实现朴素自定义设备内存拷贝函数,对比不同数据类型、大小及方法的性能,得出拷贝数据单元多、单元大及以8或16字节向量化单元拷贝可提升带宽等结论。
AI 已能写 80% 代码,但 Agent 也有致命短板!OpenAI Codex 技术总监:问错了,比不会写更麻烦
OpenAI Codex 技术负责人 Michael Bolin 在访谈中回顾职业轨迹,分享从工程师到工具创造者的成长经历。他认为 AI 编程时代 80%-90% 代码可由模型生成,但关键部分需人类把控,提出正确问题能力更重要,编程智能体执行将更多迁移到云端。
1 亿美元 ARR、不设 AI 硬件产品经理,Plaud 如何拿下全球百万用户?
本文采访了Plaud中国区CEO莫子皓。他表示Plaud更像大模型公司,硬件是获取用户context的入口。还谈到职业经历、大模型在医疗应用原因,指出做硬件要补短板,产品迭代谨慎且快,目标是拓展智能边界。
刚刚,小红书开源了首个多模态大模型dots.vlm1,性能直追SOTA!
小红书人文智能实验室(hi lab)低调开源视觉语言模型dots.vlm1。该模型基于自研视觉编码器构建,在视觉理解和推理任务上接近SOTA水平,实测表现惊艳,还介绍了其技术架构、预训练数据布局等内容。
只剩5年?诺奖得主Hassabis放出AGI时间表:还差一两个技术突破
诺奖得主、Google DeepMind掌门人Demis Hassabis给出AGI终极时间表,认为5年内或需1-2项重大技术突破就能跨越障碍。他指出大模型有局限,实现AGI需“世界模型”和“智能体系统”,还称AI将加速科学发现,中国AI模型距美国仅差数月。
你的扫描全能王,作价217亿冲刺港股IPO
扫描全能王母公司合合信息拟作价217亿赴港IPO,冲刺“A+H”双重上市。其C端有扫描全能王等产品,B端有TextIn等产品。合合以文本智能技术为核心,打造三大技术平台,C端靠付费订阅、B端卖产品模块盈利。