「模型发布」共找到 9102 篇相关文章

8

仅2G内存可跑,刚刚,谷歌开源Gemma 3n,端侧原生多模态!

谷歌全面发布Gemma 3n,将多模态AI功能带入边缘设备并在Hugging Face开源。它原生支持多模态输入输出,针对设备端优化,内存占用低,采用开创性架构,Gemma系列质量也不断突破。

PaperAgent
算法论文8

告别微调时代:拖拽式LLMs实现12000倍加速适配,输入描述,秒级定制LLM,效果、速度全面超越

传统高效微调技术成大规模部署瓶颈,论文提出Drag-and-Drop LLMs (DnD),仅需输入目标任务未标注提示,即可秒级生成适配的LoRA权重,实现LLM秒级免训练适配,效率、性能和泛化性上均有突破。

深度学习自然语言处理
新闻资讯8

突破125年世纪难题!北大校友联手科大少年班才子破解希尔伯特第六问题

1900年希尔伯特提出23个数学难题,其中第六个‘物理学的公理化’被称为数学物理的终极挑战。125年后,北大校友邓煜、中科大少年班马骁与陶哲轩高徒扎赫尔・哈尼在该问题上取得重大突破,填补了牛顿力学与玻尔兹曼方程间的逻辑鸿沟。

量子位
推荐文章7

A 路径 VS B 路径:先攻新加坡还是直取美国?中国科技出海的生死选择题

文章围绕中国科技出海展开,对比 A、B 路径,分析中美市场特点,指出中国软件市场是试炼场,还阐述开源项目全球化路径,认为新加坡可作出海首站,最后推荐 AICon 北京站活动。

InfoQ
新闻资讯7

The Batch:833 | 针对智能体的钓鱼攻击

研究人员发现误导基于大语言模型的自主智能体的方法,即通过在热门网站植入恶意链接,利用智能体对热门网站的‘隐性信任’攻击。测试显示智能体易受诱导执行有害行为。

DeeplearningAI
新闻资讯7

黄仁勋亲述:当年如何把“价值数十亿美金”的首台AI超算,亲手送给了OpenAI

英伟达CEO黄仁勋在法国巴黎演讲,讲述OpenAI获得首台AI超算的往事。2016年英伟达推出DGX - 1遇冷,OpenAI表现热情,黄仁勋亲自送机。这体现英伟达对开发者生态的重视和对未来趋势的信念。

AI寒武纪
算法论文8

时空压缩!剑桥大学提出注意力机制MTLA:推理加速5倍,显存减至1/8

在大语言模型发展中,Transformer自注意力机制有计算复杂度问题且KV缓存成推理瓶颈。剑桥大学提出MTLA,结合时空压缩策略,提升推理效率,在多任务中表现出色,代码已开源。

机器之心
新闻资讯7

WWDC 2025 让大家“失望”了?no!苹果在下一盘AI大棋

苹果WWDC 2025未推出预期AI应用矩阵,股价下跌引失望。但实则是深思熟虑之举,它开放端侧模型及工具,让开发者创新,规避风险,待AI成熟凭借优势“后发先至”。

AI工程化
推荐文章7

我在Facebook工作四年的总结与反思

作者分享在Facebook四年工作的总结反思。包括目标规划、工作价值判断、处事态度、技术与产品关系等多方面体会,如明确目标、做有价值工作、少片面结论等。

海边的拾遗者
新闻资讯7

突发!Reddit起诉Anthropic,非法访问10万次

华尔街日报消息,Reddit起诉大模型平台Anthropic,指控其非法访问网站10万次,用用户数据训练AI。Reddit称已和OpenAI、谷歌达成合规合作,此次起诉为求赔偿并让Anthropic履约。

AIGC开放社区