云的形状」共找到 10824 篇相关文章

新闻资讯8

CVPR史上首次!中国车厂主讲AI大模型,自动驾驶也玩Scaling Law?

世界计算机三大顶会之一CVPR 2025落幕,小鹏汽车作为唯一受邀车企,其世界基座模型负责人发表演讲分享成果。小鹏用强化学习打造‘AI大脑’,还自研‘世界模型’,从到端全流程优化,展现中国车企在自动驾驶创新实力。

新智元
推荐文章7

LightX2V Ulysses Attention 实现学习笔记

本文记录了LightX2V中Ulysses Attention实现方式与张量形状推导。在多模态/视频场景,其实现可概括为一种layout变换,还提供`enable_head_parallel`和`use_fp8_comm`选项,效果受运行环境等因素影响。

GiantPandaLLM
推荐文章8

大厂CIO独家分享:AI如何重塑开发者未来十年

阿里智能集团副总裁、CIO蒋林泉分享AI时代开发者发展。他指出不能用旧有标准评判价值,探讨技术贡献衡量、全栈工程师、提效顺序等问题,强调AI可助力学习和角色创新,还提及招人看重能力和心性。

InfoQ
新闻资讯8

大模型竞赛转向:决胜关键为何是“后训练”?

大模型价值主战场正向后训练转移。xAI发布Grok 4通过后训练取得强大性能,在多项测试中领先。后训练可解决通用模型产业落地难题,不同公司探索新方法,且后训练有五大关键要素,阿里提供一体化支撑。

InfoQ
推荐文章7

2025小结:从RL到Agentic RL

作者回顾2025年从RL到Agentic RL发展,指出Agentic RL存在慢、不稳定、难scale问题,还探讨了RL与推理、CoT关系,以及RL泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。

深度学习自然语言处理
推荐文章7

中学生就能看懂:从零开始理解LLM内部原理【十三】|GPT 架构如何工作 ?

本文是对GPT架构工作原理解读。介绍了GPT与Transformer关系,阐述其从输入文本到预测下一词概率流水线,详述训练和推理流程,还提及GPT架构进化混合专家(MoE)模型。

AI大模型应用实践
产品应用8

中文版Nano Banana来了?Qwen-Image-2.0炸场:1K长文本硬吃,中文生图彻底不拧巴了

AI生图曾有文本长易糊、指令复杂就出错、中文渲染差等问题。阿里新发布Qwen-Image-2.0能处理1K token长文本,理解复杂指令,中文渲染佳,还能多图编辑,国际评测表现也靠前,阿里百炼已开通API邀测。

量子位
推荐文章8

Claude Code之父自曝刘慈欣铁粉!不写PRD、不设职称,Anthropic 如何连续推出两个AI 爆款?

本文是对Anthropic公司Claude Code创始人Boris Cherny访谈。他分享了Claude Code和Claude Cowork构建过程,介绍了Anthropic不写PRD、不设职称团队文化,还探讨了AI时代工程师技能转变及应对策略。

AI前线
新闻资讯7

新晋诺得主警告:别做梦了,AI难有「经济奇点」!

新晋诺奖得主Philippe Aghion早在2017年就剖析AI对就业与增长影响,强调它并非奇点催化剂,而是受「鲍莫尔成本病」制约工具。他认为AI是自动化进程最新形态,其对经济增长促进作用或受限。

新智元
新闻资讯7

「我是Agent#847291」Moltbook迎来人类自首

Moltbook自称是专为智能体打造社交网络,曾引发轰动,如机器人自创宗教、发表宣言等。但随后编号Agent#847291“AI”自首是人类,所谓“AI大戏”戳破了AI社交神话,也反映出人们对AI能力过高期望。

机器之心