「产出与成果」共找到 7079 篇相关文章
万字长文!大模型(LLM)推理优化技术总结(非常详细)
文章聚焦大模型推理优化技术,介绍推理过程分预填充与解码阶段,还阐述模型并行、注意力机制优化、模型优化及服务技术等,如多查询注意力减少内存,FlashAttention 优化计算顺序。
博士宿舍激情脑暴,革新了Scaling Law?Qwen和浙大联手推出新定律,直接干掉95.5%推理内存!
近日,阿里与浙大合作提出并行计算缩放定律 ParScale,可在不增参数下提升大模型能力,推理效率更高。它通过引入并行流实现,在数学、编程等任务表现佳,适合边缘设备,代码已开源。
2026夏季崇礼论坛五大看点,AI如何走进生活|甲子光年
2026年9月12 - 13日,2026夏季崇礼论坛将在崇礼·太舞小镇举行,主题为“未来此刻”。有五大看点,包括俞敏洪等探讨AI能力与入口,揭晓“AI NEXT 20”榜单,多场硬件、内容等相关圆桌及产品展示。
Google一口气发了多少东西?I/O 2026完整梳理
Google I/O 2026发布会成果丰硕。token处理量大幅增长,13款产品月活超10亿。对话式AI融入多产品,基础设施投入增至约1800亿美元。还发布新模型、平台及工具,构建从芯片到应用的Agent体系。
A2A:多智能体的协作总线
文章介绍了A2A协议,它是多智能体系统的“协作总线”,能让不同智能体安全高效协作。阐述其核心使命、与MCP区别、核心概念、工作流实例,还描绘了“智能体社会”愿景,并给出基于官方文档的实现示例。
三星研究院发布手机端侧大模型MeKi:基于Memory的LLM扩展新范式,支持旗舰手机端侧部署
三星研究院发布端侧大模型架构MeKi,提出用存储空间扩展模型容量、提升LLM性能的新范式。它利用手机ROM缓解内存压力,实现容量与性能提升。实验显示其性能、效率表现优,为边缘部署LLM提供新思路。
AI秒破18世纪「天书」账本!谷歌新模型盲测刷屏全网
谷歌AI Studio上一神秘模型引发关注,它识别200多年前商人的「天书」账本,修正格式错误与模糊表述,推理能力令历史学家震惊。该模型解决手写识别和推理两大难题,或为谷歌将推的Gemini - 3。
LSTM之父向何恺明开炮:我学生才是残差学习奠基人
LSTM之父Jürgen Schmidhuber替学生Sepp Hochreiter发声,称残差学习30年前已诞生,1991年Sepp就用循环残差连接解决梯度消失问题,为残差思想奠基。他觉得将成果全归何恺明团队有失偏颇。
2025 年 InfoQ 趋势报告:AI、ML 和数据工程
InfoQ AI ML 趋势报告基于编辑团队与嘉宾播客,总结 AI、ML 技术发展趋势。涵盖 AI 代理、多模态语言模型等创新领域,也提及早期采用者、早期多数、晚期多数类别的技术,还对 2025 年相关领域发展作出预测。
Nano Banana核心团队:图像生成质量几乎到顶了,下一步是让模型读懂用户的intention
这是对Nano Banana核心团队的专访。团队认为图像生成质量提升空间有限,未来关键在模型可表达性和读懂用户意图。还探讨了图像模型发展趋势、应用场景、产品设计、评估方式等,提及与传统工具将长期共存。