新全栈」共找到 5136 篇相关文章

推荐文章8

给非技术人的大模型介绍:从零训练ChatGPT的流程、天价成本及企业务实替代方案

文章介绍从零训练ChatGPT级别大模型的流程、高昂成本,指出这对多数企业不现实。建议企业战略从构建转向应用,通过租用API或微调开源模型利用大模型,将专有数据视为核心资产。

AI Reading Hub
新闻资讯8

谷歌AI核爆:升级系模型,Gemini 2.5双榜登顶!所有产品用AI重做,OpenAI如何接招?

北京时间5月21日凌晨,谷歌在I/O大会发布众多更。模型层面,为Gemini 2.5 Pro引入推理模型和更好的2.5 Flash;谷歌搜索推出AI模式;还亮相视频模型Veo 3等,编码助手Jules公测。

InfoQ
算法论文8

超越RAG和DAPT!华人团队研究引热议:即插即用、无需改变原参即可让模型化身领域专家

华人团队提出比DAPT和RAG更方便、成本更低的方法,即“Memory Decoder”预训练记忆模块。它像“领域知识插件”,即插即用、不改原参,能让Qwen、Llama等模型成领域专家,还降低困惑度。

量子位
开源动态8

白嫖微软开源Web Agent,独立开发者的第二双手:自动刷网页、跑脚本、盯进度,交给 Magentic-UI

Magentic-UI是微软开源的Web Agent界面,能控制浏览器、执行代码等,解决长流程、重复且让人不放心交给AI的任务。它可视化操作,有可复用计划图库等亮点,使用体验好,适合特定开发者。

小华同学ai
算法论文8

给大模型「持续注入知识」,北航CASE框架:编辑千次不失忆,额外参数不到1MB丨WWW'26

北航团队提出CASE框架解决大语言模型持续吸收知识难题。该框架给编辑“算分”、调“关键神经元”,破解核心痛点。实验显示,1000次编辑后准确率提升近10%,额外参数不到1MB。

量子位
开源动态8

只训练数学,却在物理化学生物战胜o1!强化学习算法带来显著性能提升,还缓解训练崩溃问题

上海创智学院、上海AI Lab的MM - Eureka系列工作提出强化学习算法CPGD,缓解训练崩溃问题,提升性能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。

量子位
新闻资讯7

腾讯混元挖走微软明星大模型团队!一作员出走,成果已跻身大模型竞技场TOP 10

微软明星大模型WizardLM一作员加入腾讯混元,最成果Hunyuan - Turbos跻身大模型竞技场TOP 10。此前WizardLM - 2发布不顺,且微软将裁员超6000人,国内大厂正激烈争夺大模型人才。

量子位
新闻资讯7

一名员工用个 AI 工具,直接把 Vercel “送”进黑客手里!AI 还在替你决定技术,vibe 产品危?

当地时间4月19日,云开发平台Vercel确认内部系统遭未授权访问,黑客出售窃取的数据。攻击源于员工使用的AI平台Context.ai安事件。此外AI编程助手正重塑技术生态入口,影响工具选择。

InfoQ
新闻资讯7

Java 三十周年重磅发声:James Gosling 怒斥 AI 是“一场骗局”,是科技高管“疯狂压榨”程序员的工具

在 Java 诞生三十周年之际,Java 之父 James Gosling 发声,直言 AI 是“一场骗局”,是科技高管压榨程序员的工具。他回顾 Java 发展历程,还分享了自己职业生涯、对开源和行业趋势看法等。

InfoQ
算法论文8

模型砍掉一大半,准确率反升15%!华科&阿里安研究实现ViT近乎无损的类特定压缩|ICLR'26

华中科技大学联合阿里安部提出Vulcan方法,一改传统压缩策略,通过“先训练再剪枝”实现ViT近乎无损的类特定压缩,为大模型服务小场景提供路径,论文已被ICLR 2026接收。

量子位