「二本学生」共找到 468 篇相关文章
OpenAI波兰双雄:GPT不是偶然!再忆奥特曼被逐当天实况
OpenAI宫变时,Jakub Pachocki与Szymon Sidor力助奥特曼翻盘。他们高中相识,因AlphaGo加入OpenAI。ChatGPT并非偶然,是团队深耕成果。二人推动推理模型发展,强调AGI发展中对齐问题重要,要兼顾能力与安全。
当博世XC决定像创业公司一样去战斗
本文讲述博世智能驾控事业部(XC)变革故事。2022 年交付遇阻,李金龙小范围改革;2023 年订单减少,吴永桥上任展开变革。博世加大中国业务变革,像创业公司战斗,订单增长,未来左右开弓应对竞争。
Mistral的首个强推理模型:拥抱开源,推理速度快10倍
本周二,欧洲人工智能公司 Mistral AI 发布全新大语言模型 Magistral 系列,有企业版 Magistral Medium 和 24B 参数开源版 Magistral Small。它推理强、多语言表现好,速度比竞品快 10 倍,应用于主流云平台,成本有竞争力。
AIAAJ | 西工大张巧、张伟伟等:多专家特征融合网络架构预测跨声速抖振气动噪声
为解决气动噪声数据中流动状态与空间位置分布不平衡导致的MLP预测精度不足问题,本研究提出多专家特征融合网络架构,以跨声速抖振气动噪声为算例评估,可降低MLP算法MSE,泛化性更好。
中学生就能看懂:从零开始理解LLM内部原理【八】| 什么是残差连接?
本系列是对长篇文章《Understanding LLMs from Scratch Using Middle School Math》的解读笔记。本篇介绍残差连接,指出传统多层模型有网络退化和梯度传导困难问题,而残差连接能缓解,还说明了其工作原理和可行性。
无需训练!让VLM同时具备「视觉」与「推理」能力,数学题得分暴涨30%
当前视觉语言模型(VLM)像‘视力好但数学差的学生’,论文指出问题根源是数据不足和能力分布不均。提出‘模型合并’方案,实验显示在数学基准测试中表现亮眼,还通过实验揭示层间能力分布。
疯了,A社IPO大饼画到30万亿美元!一个美国的GDP
华尔街日报爆料,Anthropic将告诉投资人其潜在收入机会超30万亿美元,已秘密递交IPO草案。该数字是标普1500里191家科技公司去年营收总和的12倍,算法是把AI能接手的工作全算进去。公司内部面试还筛人,很割裂。
电脑操作、技能、连接器、工作伙伴:豆包的牌来了
最近字节有两个豆包相关新闻,一是在训练超大模型,二是反对模型蒸馏。豆包上线大批 Agent 相关工作任务能力,覆盖办公场景,如电脑操作、技能商店等,过程流畅且可观察,还更新移动端,实现远程控制。
斯坦福辍学生奥特曼:AI时代,大学上两年就够了
在面向科技实习生的活动上,有人问AI时代读大学是否必要,奥特曼认为要读,但四年太长,两年刚好,还列举盖茨等辍学生成功案例,强调辍学非成功公式,大学应给学生更多保障。
刚被马斯克收购,Cursor掏出新模型:10万卡加持,和Opus、GPT一样大
本周二,刚被SpaceX收购的Cursor在首届旗舰大会宣布新的1.5万亿+参数模型,在超10万块GPU预训练。Cursor CEO称其规模与Opus、GPT相当,还谈了对其他AI实验室看法,新模型将几周内发布。