降本增效」共找到 587 篇相关文章

8

谷歌公开全新极限压缩算法:LLM提速8倍、内存占用狂6倍,精度零损失

谷歌推出全新量化算法 TurboQuant,瞄准大模型键值缓存吃内存、高维向量搜索算力瓶颈痛点,能砍内存、提速度且精度零损失。分 PolarQuant 和 QJL 两步,实验数据表现优异,将改变搜索格局。

AI寒武纪
新闻资讯7

百度“龙虾” 全家桶亮相,多款龙虾产品上新,家用小度虾也来了

3月17日百度AIDAY龙虾专场,百度“龙虾”全家桶亮相,多款产品上新。百度集团沈抖谈OpenClaw趋势,还推出桌面AI智能体DuMate、“家用小龙虾”等,多个Skills也发布,持续低体验门槛。

AIGC开放社区
产品应用8

史诗级痛点修复!GPT-5.3 Instant 突发上线:写作,语气,准确度全面升级

ChatGPT目前使用率最高的模型GPT-5.3 Instant正式上线,核心优化用户日常交互体验,解决此前反馈强烈的痛点,如削减拒答与说教、让对话更自然、优化联网搜索等,还低幻觉率,提升写作辅助能力。

AI寒武纪
新闻资讯7

FriendliAI获2000万美元,以加速AI模型推理工作负载

专注AI推理的初创平台FriendliAI获2000万美元种子扩展轮融资,资金用于加速平台开发。其专有推理优化技术可低模型运行成和能耗,能为用户省90%的GPU成,合作客户广泛。

AIGC开放社区
算法论文8

Discrete Tokenization:多模态大模型的关键基石,首个系统化综述发布

近年来,人们关注将LLM能力扩展至非文模态,Discrete Tokenization成关键方案。但现有研究缺系统总结,香港科技大学等团队发布首个相关系统化综述,梳理技术脉络、方法及挑战,给出未来研究方向。

机器之心
开源动态7

“老中间件”自救:昔日并发王者、十五年开源老将全力押注Agentic AI找活路,转型做 Java 版 LangChain

7月14日,老牌开源中间件Akka发布Agentic Platform,向AI驱动型系统转型。其运营曾面临挑战,现全力押注Agentic AI,认为这是第五次计算浪潮,将构建比Langchain更丰富的功能集。

InfoQ
算法论文8

单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成高,低秩适应(LoRA)方法虽低成,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
新闻资讯8

矩阵起源(MatrixOrigin)完成超千万美元A轮融资 | 5Y News

2026年8月6日,企业级AI基础设施厂商矩阵起源完成超千万美元A轮融资,由汉得信息参与投资的基金、亚康股份与Artesian Venture Partners注资。资金用于平台研发、市场拓展等。其产品具优势,获多方认可。

五源资本 5Y Capital
产品应用8

更快更省!Vidu Q3硬核升级打响AI视频普惠第一枪 | 甲子光年

2026年AI视频行业内容产出增长迅猛,但成上涨、生成慢等问题凸显。生数科技的Vidu Q3模型全面升级,生成速度提升5倍、价格低,适配多场景,为AI视频普惠工业化提供范例。

甲子光年
新闻资讯7

Anthropic冲刺9000亿美元估值:48小时定生死,两周内见分晓

Anthropic给潜在投资者下48小时参与融资的最后通牒,融资规模约500亿,目标估值9000亿。部分早期投资者跳过,公司需资金支撑算力。若达成,将超OpenAI,这或为上市前最后一轮私融。

AI工程化