系统级优化」共找到 3490 篇相关文章

开源动态8

HF日趋榜一!真端到端模型AutoDeco终结手动调参解码

大语言模型手动调参解码繁琐,腾讯AI Lab王琰团队联合港中大(深圳)唐晓莹教授团队推出AutoDeco架构,通过创新训练策略让模型动态预测解码参数,在多模型实验中表现出色且已开源。

机器之心
开源动态8

LangChain 彻底重写:从开源副业到独角兽,一次“核心迁移”干到 12.5 亿估值

本周,LangChain 宣布完成 1.25 亿美元融资,投后估值 12.5 亿美元,还发布里程碑式更新,LangChain 1.0 正式登场,这是一次从零开始的重写。它最初是副业,后成热门开源项目,此次重写解决了过往问题。

InfoQ
新闻资讯8

红色警报:OpenAI的Atlas浏览器,是捅向谷歌万亿心脏的匕首吗?

OpenAI推出ChatGPT Atlas浏览器,争夺全球互联网入口,直指谷歌核心业务命脉。谷歌核心收入源于搜索广告,Chrome是确保流量的关键。而Atlas以‘回答’和‘执行’为核心,或让谷歌广告竞价系统失效,谷歌必将强力反击。

新智元
推荐文章7

AI时代,为什么你又焦虑又学不进去?这个人破解了专注力的秘密

文章指出AI时代人们学不进去,原因在于信息爆炸、AI工具易致分心,本质是没学会处理学习不适。介绍了Time Boxing、“10分钟法则”等应对方法,强调专注力是新学习力,要预先规划建立学习系统

花叔
算法论文8

稳定训练、数据高效,清华大学提出「流策略」强化学习新方法SAC Flow

本文介绍清华大学和CMU提出的SAC Flow新方案,可端到端优化流策略。它将流策略视作residual RNN,用GRU和Transformer结构稳定训练。在多环境测试中表现优,有稳定、快速、样本效率高的特点。

机器之心
算法论文8

ACL 2025 | GALLa:给代码大模型装上“透视眼”,看懂程序的“骨架”!

蚂蚁集团与上海交大合作的 GALLa 研究被 ACL 2025 主会录用。它利用图神经网络将代码图结构信息注入大模型,在 7 个模型和 5 个任务上提升性能,推理与普通 LLM 一致,不增成本。

PaperAgent
推荐文章7

《中国Data&AI数据基础设施白皮书》——AI创生核心生产力,开启万亿新基建之路 | 甲子光年智库

全球正处地缘政治与AI技术变革中,AI跃升为核心生产力。中国企业面临‘挤压式转型’,传统数据系统难满足需求。数据厂商需构建新一代数据基础设施,技术上‘湖仓一体’与‘AI原生’融合,推动Data&AI一体化。

甲子光年
算法论文7

翁荔陈丹琦加盟的840亿AI公司,公开第二篇论文

明星创业公司Thinking Machines公开第二篇研究论文,主题为“Modular Manifolds”,通过统一框架约束和优化网络不同层/模块,提升训练稳定性与效率。论文提出模块化流形思路,若应用于大模型,训练效率和稳定性将大幅提升。

量子位
产品应用8

又一款国产高性能GPU问世,实力对标海外巨头

2025年9月22日,芯动科技发布“风华3号”全功能GPU,它架构全面,功能覆盖广,在大模型等领域有多个突破,还适配多生态与系统。该产品能为多行业定制服务,标志国产GPU进入规模化应用阶段。

芯师爷
产品应用8

腾讯用AI把美术管线重新做了一遍,混元3D Studio架构曝光

腾讯推出专业AI工作台混元3D Studio,可覆盖3D资产生产全流程,让生产周期大幅缩短。它有组件拆分、可控图像生成等七大核心技术模块,各模块对应关键阶段,实现无缝衔接与自动化。

量子位