「AI学习范式」共找到 10849 篇相关文章
7万个模型、1600万开发者,阿里魔搭已建成中国最大AI开源社区
首届魔搭开发者大会公布,魔搭社区开源模型超7万个,用户达1600万,成中国最大AI开源社区。阿里云CTO周靖人认为‘云端协同’是重要课题,魔搭要覆盖模型全生命周期,减少模型落地差距。
直播预约 | 强化学习训练能否不依赖外部知识优化模型的弱点?
论文提出 SwS 框架,针对强化学习场景,利用模型自我感知弱点驱动自动化问题生成,合成针对性训练数据。还对其进行多项扩展,在多个基准测试集和模型上验证有效,性能提升显著。
刚刚,Ilya又发神图「思考者」!AI芯片海洋上在想啥?
AI圈神秘领袖Ilya在Instagram上传画,画面是「思考者」踩在芯片Die Shot上,引发全网解读。同一时间,OpenAI公布数学成果、升级Codex,还传准备秘密提交IPO招股文件,引发新一轮狂欢。
估值315亿!田渊栋AI创业,谷歌、英伟达和AMD参投
Meta离职的田渊栋官宣创业,成立RSI,获6.5亿美元融资,估值约316亿。8位联创阵容豪华,团队致力于构建开放式架构,让智能体自主学习升级,目标打造具5万博士能力的智能系统。
一年一度最值得关注的AI榜单来啦!申报即日启动
中国生成式AI进入产业深水区,值第四届中国AIGC产业峰会,量子位将评选2026年度值得关注的AIGC企业和产品,介绍了参选条件、评选维度,即日起报名,4月27日截止,结果5月峰会公布。
多模态推理新范式!DiffThinker:用扩散模型「画」出推理和答案
上海人工智能实验室等团队提出全新生成式多模态推理范式,发布模型 DiffThinker。它打破传统定式,以图像到图像生成任务重构推理过程,在多项复杂任务中表现优于顶尖闭源模型,有四大核心特性。
一家营收千亿美元的公司,如何回应 AI 落地的策略问题
2025年9月19日,Qwen3和DeepSeek v3.1上线Amazon Bedrock。该产品秉持“Choice Matters”理念,为不同业务选适配基础模型,上架超二百余款模型。亚马逊云科技副总裁总结选模型要点,其策略影响AI落地进程。
在WAIC,比起看机器人打拳,人们更想知道怎么用AI赚钱
7月27日普通观众参观日,WAIC现场火爆。本届大会规模为历届之最,机器人与模型厂商纷纷展示落地应用。机器人从“能动”走向“会干”,模型厂商聚焦场景,投融资锚点转向商业指标。
高通将以24亿美元收购Alphawave Semi,增强AI数据中心份额
高通官网宣布以24亿美元收购Alphawave Semi全部已发行及待发行普通股票,旨在加速其数据中心领域扩张。Alphawave技术能实现高速数据传输,与高通处理器互补,双方将携手推动AI计算等领域发展。
MIT学生48小时学完一学期的课,90%的人用错了AI
社交媒体热帖揭秘MIT学生48小时学完一学期课程的方法。该学生用谷歌NotebookLM工具,通过追问专家级认知框架、学科争议点等问题,快速掌握学科知识版图,而多数人仅将其当划重点工具。