「产出与成果」共找到 7166 篇相关文章

推荐文章8

【万字长文】大模型训练推理和性能优化算法总结和实践

本文总结大模型落地的训练、推理和性能优化算法与实践,介绍语言模型发展,对比BERT、GPT等训练方式,分析生成式大模型问题,还阐述数据处理、推理优化及训练调优等内容,并给出不同场景技术选型建议。

阿里云开发者
新闻资讯7

先验+后验加持,大模型能否 hold 住推理预测的现实「溢出」?

多数大模型评估基准依赖固定数据集,难测真实推理实力。字节跳动等推出的 FutureX 动态评测基准,将重点移至动态预测能力。实验显示不同模型在不同任务表现有别,大模型在现实场景运用仍待优化。

机器之心
新闻资讯8

快手解密「AI印钞机」,首提生成式强化学习出价技术,为平台实现超过3%的广告收入提升

文章介绍快手首提生成式强化学习出价技术,为平台提升超3%广告收入。还阐述广告自动出价挑战及业界方案,介绍快手GAVE和CBD算法破解难题,其团队成果丰硕,未来技术有两大演进方向。

机器之心
7

你可能没注意,腾讯已经把 AI 融进了这两个关键场景

作者参加腾讯全球数字生态大会AI协同办公与组织升级专场,关注腾讯乐享AI知识库和腾讯电子签合同智能引擎。乐享解决传统知识库痛点,让知识融入工作流;电子签实现合同管理全流程智能化,解放法务劳动力。

MacTalk
产品应用8

斯坦福李飞飞团队,带你一句话进入无限3D世界

斯坦福李飞飞团队推出Marble平台,能将图片或文字变成3D世界。其有持久存在、可自由导航、可自定义操控等特性,技术或与3DGS有关,实测领先竞品,World Labs获巨额投资,估值超10亿美元。

AIGC开放社区
新闻资讯7

Mira Murati 创业公司首发长文,尝试解决 LLM 推理的不确定性难题

OpenAI前CTO Mira Murati创立的Thinking Machines Lab首发文章《克服LLM推理中的不确定性》,指出大语言模型推理难获可复现结果,深入探究其不确定性根源,提出使核函数具备批次不变性的方法并给出实现与实验。

Founder Park
新闻资讯7

Altman亲自发博客点赞,这两大杰出人才是谁?

Altman发博文介绍OpenAI两位核心研究员Jakub Pachocki和Szymon Sidor,称他们结合前沿研究与工程实践,对公司发展至关重要。文中还介绍两人履历贡献,提及OpenAI“宫斗”及用户对ChatGPT语音和GPT - 4o的不满。

机器之心
新闻资讯7

刚刚,光刻机霸主ASML被曝成为Mistral最大股东!网友怒斥:ASML的钱将打水漂

9月7日消息,ASML注资15亿美元成Mistral最大股东,旨在加强欧洲科技主权。此轮融资或使Mistral估值达140亿美元。业内认为这是战略押注与潜在协同。网友看法不一,而Mistral因开源和团队背景受关注。

InfoQ
算法论文8

POF | 西交大陈泽伟、陈刚等:面向可变形域非周期非定常流动的几何自适应时空深度学习框架

西交大陈泽伟、陈刚等人提出ViT - STFlowNet框架,用于可变形域非周期非定常流动预测。该框架融合自适应网格变换与ViT架构,克服传统方法局限,测试显示预测精度高、泛化能力好,为飞行器流场感知控制提供工具。

力学与人工智能
推荐文章7

AI 原生应用全栈可观测实践:以 DeepSeek 对话机器人为例

本文以 DeepSeek 对话机器人为例,介绍 AI 原生应用架构可观测需求、挑战与方案实践。分析 AI 领域痛点,提出阿里云 AI 全栈可观测架构,剖析大模型应用可观测技术,分享实战案例,还给出未来规划。

InfoQ