全栈优化」共找到 3017 篇相关文章

开源动态8

腾讯AngelSlim升级,首个集LLM、VLM及语音多模态为一体的投机采样训练框架,推理速度飙升1.8倍

随着大模型应用成本与延迟问题凸显,腾讯混元升级 AngelSlim 训练框架,将投机采样技术拓展至模态场景。它以 Eagle3 架构让推理速度最高飙升 1.9 倍,还具模态训练、面向部署等亮点,有开源代码。

机器之心
新闻资讯8

MiniMax今早上市,股价疯涨80%!一群95后跑通了中国AI的价值

1月9日9:30,MiniMax于港交所上市,截稿时股价疯涨近80%。该公司仅用约5亿美元便让模态模型进入国际第一梯队,员工平均年龄29岁。其以低投入、高产出及球化业务,展现了中国AI的实力与潜力。

新智元
算法论文8

Auto Research时代,47个没有标准答案的任务成了Agent能力必测榜

Einsia AI旗下Navers lab发布Agent Benchmark——Frontier-Eng Bench,让AI在47个多学科交叉的硬核任务中做工程优化,测试其迭代优化能力。研究总结出AI进化规律,初步勾勒接近真实工程循环的AI系统。

量子位
产品应用8

TRAE SOLO 移动端发布!超级 Agent 终于走出了桌面

TRAE SOLO 移动端正式上线,同时 Windows 版本也同步发布,实现手机、PC、Web 三端量开放且无需邀请码。它能完成多种任务,三端任务信息实时量同步,设备配对简单,在生产力场景实测效果出色。

特工宇宙
推荐文章8

18 年 SEO 增长经验专家:别再收藏各种 AEO 最佳攻略了,自己动手实验才是做好的关键

18年SEO增长经验专家Ethan Smith与Lenny对谈,指出网上多数AEO信息不准确,做好AEO要自己动手验证。还分享AEO玩法、与SEO区别、优化策略等,强调100%AI生成内容不可行,要优化帮助中心内容。

Founder Park
算法论文7

deepseek-V4算法工程技术深入浅出

文章围绕deepseek V4技术报告展开,指出当前大模型训练不充分,介绍了算法层面如混合注意力机制、模型结构优化优化器等,工程层面如细粒度专家并行、算子内核开发等,以及后训练的范式转变和领域专家网络蒸馏等内容。

Agent的潜意识
产品应用7

球首款120通道PCIe5交换芯片面世,为国产AI基础设施赋能

随着AI算力需求增长,芯动科技推出球领先的104/120通道PCIe Gen5交换芯片。该芯片功能及性能面对标国际行业龙头,可适配场景应用,其落地标志国产高端PCIe交换芯片实现关键跨越。

芯师爷
新闻资讯8

不只是DeepSeek V4,还有个万亿级大模型,训推程国产芯片

2026年4月24日,DeepSeek发布新一代模型DeepSeek - V4系列预览版并开源。同日,美团用国产算力集群训练出万亿参数大模型LongCat - 2.0系列预览版,训推流程摆脱英伟达,在国产算力支撑万亿级模型研发上取得突破。

机器之心
开源动态8

NVIDIA重磅开源!OmniVinci 仅 9B 模型就拿下多模态冠军!

英伟达推出模态大语言模型 OmniVinci,架构有三大创新。OmniVinci - 9B 模型表现亮眼,多测试中大幅超 Qwen2.5 - Omni,且训练量仅为其六分之一。其架构经多阶段流程实现模态理解,还支持多种功能。

带你学AI
算法论文8

AI问答,直接「拍」给你看!来自快手可灵&香港城市大学

来自快手可灵团队和香港城市大学的研究者提出「视频作为答案」任务范式,发布VANS模型。它由视觉语言和视频扩散模型构成,通过联合分组相对策略优化算法协同优化,在教学和预测应用上效果超现有模型。

量子位