「落地应用」共找到 2928 篇相关文章
【万字长文】大模型训练推理和性能优化算法总结和实践
本文总结大模型落地的训练、推理和性能优化算法与实践,介绍语言模型发展,对比BERT、GPT等训练方式,分析生成式大模型问题,还阐述数据处理、推理优化及训练调优等内容,并给出不同场景技术选型建议。
先验+后验加持,大模型能否 hold 住推理预测的现实「溢出」?
多数大模型评估基准依赖固定数据集,难测真实推理实力。字节跳动等推出的 FutureX 动态评测基准,将重点移至动态预测能力。实验显示不同模型在不同任务表现有别,大模型在现实场景运用仍待优化。
前端工程化演进之路:从手工作坊到AI驱动的智能化开发
本文回顾前端开发从jQuery到AI的变革,剖析工程化演进、性能优化进化,展示AI与前端深度融合新范式。还预测未来趋势,为开发者提供成长路径指导,强调工程化、性能优化、AI应用及持续学习的重要性。
Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention
这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达性和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。
从少样本到千样本!MachineLearningLM给大模型上下文学习装上「机器学习引擎」
新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力大,还指明未来研究方向。
本周推荐的5个超级6的Github开源项目!
文章推荐了5个Github开源项目。如htmx,能在纯HTML搞定多种交互,无需JS;Flow.Launcher可快速搜索文件、启动应用;Maple Mono是编程字体,中英2:1对齐;Trilium Notes是分层笔记神器;Hyprnote可实时转录会议内容。
美团也开源了大模型,但我觉得他们的野心是通用生活Agent。
美团发布并开源560B参数的MoE模型LongCat - Flash - Chat,推理速度快。与DeepSeek V3对比,输出速度优势明显。美团多个落地或内测AI功能服务C端生活场景,目标是打造通用生活Agent。
刚刚,OpenAI把1GW超算中心直接给了印度!奥特曼即将亲赴三哥办事处
OpenAI计划在印度建设至少1GW规模的数据中心,这是「星际之门」计划首次大规模进入亚洲。印度用户增长潜力大,还有多语言应用场景。虽奥特曼淡出CEO角色,但亲自推动全球算力布局,印度是关键起点。
斯坦福发布预警信号:生成式AI正如何重塑就业市场?年轻职场新人首当其冲
斯坦福大学Erik Brynjolfsson教授领衔的论文,用海量高频薪资数据研究AI就业效应。发现高AI暴露职业中年轻职场新人就业显著下降,自动化型AI应用致就业降,增强型则无,还给出年轻人受影响大的原因。
最高提效8倍!腾讯游戏发布专业游戏AI大模型,美术师做动画不用辣么“肝”了
在Devcom开发者大会上,AI成焦点。腾讯游戏发布游戏创作AI全链路解决方案VISVISE,含动画制作等四大管线,能辅助美术完成重复工作。如MotionBlink可自动补帧,GoSkinning已在多游戏应用,提升了制作效率。