新全栈」共找到 5117 篇相关文章

新闻资讯8

谷歌年度大招:所有AI模型升级一遍!Gemini2.5大杯中杯霸榜前二,版视频/图像模型亮相

谷歌在I/O大会放大招,升级所有AI模型,重做原有产品,推出诸多实验性产品。如Gemini 2.5系列升级,具备功能;还有异步代码助手Jules、搜索模式等,多模态模型也线升级。

量子位
产品应用8

2.4万亿参数原生模态,文心5.0一手实测来了

文心5.0正式发布,主打原生模态,支持模态输入和输出。官方测试显示其多维度表现突出,在LMArena文本排行榜并列球第二。实测其理解精细、能捕捉细节,技术上采用自回归统一结构和超大规模混合专家架构。

量子位
推荐文章8

Thinking Machines又发高质量博客:力推LoRA,不输量微调

Thinking Machines 博客力推 LoRA 并与量微调对比。研究发现小数据量任务中 LoRA 与量微调效果接近,大数据量稍吃力,强化学习中低秩 LoRA 也能接近量微调。还揭示了 LoRA 关键要素、超参数规律等。

机器之心
产品应用8

模型亦是 Agent,Kimi-Researcher 超大量一手实测!

2025 年被称为“Agent 元年”,月之暗面发布了端到端强化学习训练的一代 Agent 模型 Kimi - Researcher,其基座是自研模型。文章对其进行大量实测,与 OpenAI 等对比,并探讨了 Deep Research 的重要性及 Kimi 的不足。

特工宇宙
开源动态8

刚刚,DeepSeek 突发梁文锋署名论文:V4 架构提前曝光?

今天凌晨,DeepSeek在GitHub开源论文与模块Engram,论文提出“查—算分离”机制,通过可扩展查找记忆结构提升模型表现。Engram将记忆与计算职责分离,或成V4核心技术,获网友肯定。

InfoQ
开源动态8

刚刚,DeepSeek 突发梁文峰署名论文:V4 架构提前曝光?

今天凌晨,DeepSeek在其GitHub官方仓库开源了论文与模块Engram。该论文提出“查—算分离”机制,通过引入可扩展的查找记忆结构,在等参数、等算力条件下提升模型表现,代码与论文文均已开源。

AI前线
新闻资讯8

翻译界的ChatGPT时刻!Meta发布模型,几段示例学会冷门语言

Meta人工智能研究团队发布Omnilingual ASR系统,能识别1600多种语言,可通过少量示例快速学会语言。它以开源与社区共创为核心,打破语言技术不平等,让更多语言登上AI舞台。

新智元
新闻资讯8

谷歌AGI底座降临!首个原生模态嵌入模型上线,已实现模态SOTA

谷歌发布首个原生模态 Embedding 模型 Gemini Embedding 2,将文本、图、音视频及 PDF 融于统一向量空间,实现跨模态检索,降低架构成本,赋予 AI 连贯「记忆」,是重塑 AI 基建的里程碑。

新智元
开源动态7

OpenAI突然开源模型!99.9%的权重是0,稀疏性方法代替MoE

OpenAI悄悄开源模型,0.4B参数且99.9%权重为零,是Circuit Sparsity技术的开源实现。该技术通过约束模型内部连接稀疏性,解决传统稠密Transformer黑箱问题,或让MoE模型走上末路,但目前算力成本极高。

量子位
新闻资讯7

马化腾内部员工大会安利「元宝派」玩法,结合腾讯优势开启AI社交赛道

腾讯2026年员工大会上,马化腾强调保持定力。过去一年混元大模型深度重构,吸引人才。AI助手元宝发展佳,即将推出“元宝派”玩法,还针对春节推10亿现金红包活动,马化腾现场安利。

AI科技评论