「智源大会」共找到 5916 篇相关文章
新任IEEE Fellow要来参加雷锋网GAIR大会啦!
2026年IEEE新晋Fellow名单公布,348位学者入选,其中华人126位,AI领域42位。付昊桓等学者研究聚焦高性能计算等领域,付昊桓将在12月12日GAIR大会演讲。IEEE Fellow是学会最高荣誉,当选者贡献重大。
从传统编程转向大模型编程
文章指出大模型编程时代,开发者要从‘代码产出者’变为‘文档定义者’,介绍其优势、人+AI结对编程模式,还提及模型工具技巧、开发流程、常见陷阱及应对策略,强调文档驱动和安全合规。
沐曦过会,投资人已赚麻
10月24日,沐曦股份科创板IPO申请过会,与摩尔线程争夺“国产GPU第一股”。其5年发展迅速,产品有竞争力,融资超百亿,估值超210亿。未上市前,投资人已获利,葛卫东浮盈约2亿,相关上市公司股价也上涨。
上交大智能计算研究院论文:不只算对答案,大模型如何真正学会运筹建模丨ICLR 2026
上海交大智能计算研究院提出 StepORLM,通过生成式过程监督提升运筹建模可靠性。研究反思传统训练范式局限,在多数据集测试中,小参数的 StepORLM 表现超大型模型,还分析现有方法缺陷并提出解决框架,有重要方法论和应用意义。
大模型听懂语音却反而变笨?港中深与微软联合解决语音大模型降智问题
从GPT - 4o开启全能交互时代后,Speech LLM面临“模态推理鸿沟”问题,输入从文本变语音,推理能力显著衰退。港中深与微软联合提出TARS框架,通过三项创新解决此问题,实验显示推理能力100%复原。
DeepSeek点燃大模型效率之争,阶跃火速接棒:JetSpec让大模型解码速度最高提升近10倍
近期,DeepSeek发布DSpark,阶跃星辰发表JetSpec论文,二者聚焦大模型推理效率。DSpark关注验证效率,JetSpec从Draft生成本身入手。结果显示,二者都有加速效果,共同表明推理效率正成Agent落地关键变量。
国产大模型「五强争霸」,决战AGI!
中国基础大模型市场形成「基模五强」格局,包括字节、阿里、阶跃星辰、智谱和DeepSeek。它们要么有钱,要么有人,各有特色与优势。未来竞争焦点是追求更高「智能上限」和突破「多模态能力」,决战AGI。
清华唐杰团队揭示大模型记忆全景
清华唐杰教授团队等发布大模型记忆架构综述,提出三维记忆分类学,将前沿工作统一到理论框架,为LLM设计指明方向,分析了隐式、显式记忆架构,还探讨混合架构挑战与未来方向。
斯坦福HAI大重组!李飞飞升任校长顾问
5月4日,斯坦福大学宣布将Stanford HAI和Stanford Data Science合并为Stanford HAI,由James Landay掌舵。李飞飞升任校长AI特别顾问,与John Hennessy任HAI顾问委员会联席主席。合并后的HAI明确三大支柱,强调开放。
让大模型异步地增强推理能力
在大模型推理时代,Test - Time Scaling成提升能力重要方向,但面临效率问题。ATTS提出异步框架,加入共形预测筛选候选路径,实验显示其加速显著,将测试时扩展推进到‘有原则加速’阶段。