「搜索智能体模型」共找到 9783 篇相关文章

新闻资讯7

微软这支神秘的华人AI团队加入腾讯混元,曝与裁员无关|独家

WizardLM项目创建者徐灿发文称团队离开微软加入腾讯混元。混元此前发布多款AI模型,WizardLM也发布过混元模型。该团队专注高级大语言模型开发,曾成绩斐然,但也面临模型部署挑战。腾讯大力投入AI,网友对此看法不一。

AI前线
新闻资讯7

独家|前DeepSeek核心研究员魏浩然出任百度文心多模态算法负责人

9月3日消息,原DeepSeek核心研究员魏浩然带队转入百度,任文心大模型多模态算法负责人。此前他在多模态与端到端OCR底层重构有突出成绩,这是百度布局青年顶尖研发人才的又一动作。

AI前线
产品应用7

80%代码由Claude合并,Anthropic内部人员点破Agent真相:「Close the Loop」

Anthropic团队研究产品经理Theo演讲指出,Claude已深入其工程流程,超80%代码由它合并。模型角色转变,能力提升,失败率下降。开发者应升级研发战术,如刷新评估基准、精简“脚手架”、闭环设计。

机器之心
新闻资讯7

Karpathy 教它的 nanochat 数单词里有几个“r”

Andrej Karpathy 教超小型语言模型 nanochat d32 数单词里字母 r 的数量,创建 SpellingBee 合成任务微调模型,虽像填鸭式教学但有效,不过小模型上下文处理能力有限。

AI工程化
开源动态8

4B参数实现理解、推理、生成、编辑一体化!InternVL-U重磅开源

上海人工智能实验室联合多所高校开源多模态一体化模型 InternVL-U,仅 4B 参数,突破现有统一多模态模型瓶颈,在复杂场景超越 14B 级模型,已全面开源,提供推理代码等。

OpenMMLab
开源动态8

真实科研水平集体不及格!全新基准SFE给主流多模态LLM来了波暴击

上海人工智能实验室AI4S团队推出SFE评测基准,首创三级评估体系,涵盖五大科学领域66项任务。评测显示主流MLLMs在高阶科学任务有挑战,不同模型、学科表现有差异,还构建了SciPrismaX平台推动AI科学评估生态发展。

机器之心
推荐文章7

TileLang深入详解-第一章-GPU 体系结构复习

作者借长假学习 TileLang 并撰写此文,先复习 GPU 体系结构,包括计算与线程组织、存储层次、专用指令单元,接着介绍核心性能模型与优化原理,最后给出基于 TileLang 的基准测试实践。

GiantPandaLLM
算法论文8

VLA动作预测必须经过LLM吗?TurboVLA仅0.2B参数,RTX 4090上跑出32Hz在线动作预测

近年来,VLA模型成通用机器人控制重要路线,但模型大、动作更新慢的矛盾凸显。华中科技大学联合华为提出TurboVLA,绕开大语言模型,形成V+L→A路径,降低成本,保持操作能力。

机器之心
产品应用8

刚刚,全球AI生图新王诞生!腾讯混元图像3.0登顶了

LMArena竞技场发布文生图榜单,腾讯混元图像3.0夺冠,超越谷歌、字节和OpenAI等模型。它是原生多模态模型,语义理解强,核心技术独特,经多阶段训练,效果能与顶尖模型媲美。

量子位
产品应用7

给 AI 建「流水线」,九章云极看清了什么?

AI产业竞争重心转变,当前缺智能生产度量基础设施。九章云极6月17日发布“AI工厂”战略及智算云3.0,构建从算力到智能的工程体系,试图填补空白,让智能生产可计量。

AI科技评论