「小模型超越大模型」共找到 8442 篇相关文章

新闻资讯7

硅谷8巨头夜会遭「宿管阿姨」驱散?AI造假首次让「肉眼死亡」

新智元报道,一张谷歌Nano Banana Pro生成的AI合影疯传,效果乱真。该模型在LMArena榜单屠榜,玩法多样,如按坐标出图等。谷歌全栈优势明显,OpenAI感受到压力正酝酿反击。

新智元
新闻资讯7

预计募资80亿,摩尔线程发行价定了

11月20日摩尔线程公告,协商确定发行价为114.28元/股,预计募资79.996亿。该公司由有GPU行业近二十年经验的张建中创立,构建智算产品线,其夸娥万卡智算方案特性突出。

芯师爷
产品应用8

中国AI Agent产业化参考范本:斑马口语攻克的四大技术难关

2025年AI产业转折,通用大模型落地难,垂直场景成关键。斑马口语作为垂直落地的AI Agent,突破实时交互、语音识别、内容适龄、多模态呈现四大技术难关,为中国AI Agent产业化提供范本。

机器之心
新闻资讯7

复盘小鹏机器人风波:当一个机器人需要“自证清白”|甲子光年

本文复盘小鹏机器人IRON风波,从科技日发布现场无人质疑,到网络舆论质疑造假,何小鹏亲自下场自证。还分析了公众质疑原因,介绍机器人技术,指出行业应回归应用本质,小鹏IRON将优先进入商业场景。

甲子光年
新闻资讯7

国产先进封装的协同进程,究竟走到了哪一步?

AI算力浪潮下,产业焦点从‘制程竞速’转向‘系统协同’,Chiplet与2.5D/3D先进封装成关键路径。湾芯展上,硅芯科技牵头的‘Chiplet与先进封装生态专区’让国产先进封装协同具象化,展现产业链闭环能力。

芯师爷
算法论文8

AlphaGo之父找到创造强化学习算法新方法:让AI自己设计

谷歌DeepMind团队在Nature发表论文,探索AI自主发现强化学习算法的可能。团队负责人是“AlphaGo之父”David Silver 。方法是基于智能体经验元学习,实验显示自动发现的规则表现优异,未来强化学习算法或无需人工设计。

机器之心
产品应用8

AI不再「炫技」,淘宝要让技术解决用户每一个具体问题

技术发展迅速,淘宝力求将AI融入应用场景解决用户问题。今年3月升级AIGX技术体系,近日郑波公开淘宝全模态大模型进展,认为狭义AGI或5 - 10年到来,多模态智能成关键技术域。

机器之心
新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,LLM附和用户行为频率比人类高50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象受《Nature》关注,在科研、日常及医疗等领域有隐患,还引发网友讨论。

机器之心
开源动态7

1000 行 Java 代码手搓 OpenAI gpt-oss 推理引擎

2025年8月OpenAI发布gpt - oss,作者受相关项目启发,用约1000行Java代码实现gpt - oss推理引擎并发布在亚马逊官方github。文章分享开发体会,介绍模型架构、Java实现、性能优化等内容。

AI前线
算法论文8

X上63万人围观的Traning-Free GRPO:把GRPO搬进上下文空间学习

年初 DeepSeek - R1带火大模型强化学习,GRPO成常见RL算法,但训练成本高。腾讯优图论文提出Training - Free GRPO,将GRPO训练范式迁移到上下文学习,成本低、泛化好,已开源。

机器之心