中科大」共找到 6820 篇相关文章

新闻资讯7

3年手搓ChatGPT!剑桥天才少年在Minecraft游戏爆火回归

MC神sammyuri时隔3年发布新作,在MC复刻ChatGPT,名为CraftGPT。虽参数量小,但用Transformer架构,能和用户交互。模型训练用Python和小数据集,视频存档公布助理解原理。

新智元
产品应用7

用 Docker 跑模型训练,Unsloth 解决了环境配置难题

Unsloth AI 发布 Docker 镜像版本,解决本地训练模型环境配置难题。拉镜像就能训练,依赖和示例 notebook 都打包好。使用简单,不过有暂不支持 Mac 系统等限制,单卡 NVIDIA GPU 场景较适用。

AI工程化
算法论文8

模型哪里出问题、怎么修,这篇可解释性综述一次讲清

来自多机构的研究团队发布“可实践的机制可解释性”综述,通过 'Locate, Steer, and Improve' 三阶段范式,为模型的对齐、能力增强和效率提升提供方法论,还梳理可解释对象体系和干预手段。

机器之心
新闻资讯8

火山引擎发布豆包模型1.6,加速Agent规模应用

6月11日,火山引擎举办Force原动力会,发布豆包模型1.6、视频生成模型Seedance 1.0 pro等,升级Agent开发平台。豆包1.6表现优异,应用广泛;Seedance 1.0 pro评测领先。还通过创新定价等推动Agent规模化应用。

AIGC开放社区
推荐文章8

Anthropic 2026 Agentic Coding 趋势报告:软件开发的 8 变革

Anthropic《2026 Agentic Coding Trends Report》基于企业实战数据,总结了AI编程Agent重塑软件开发的8趋势,分基础、能力、影响三类,附企业案例,还给出2026年四优先事项。

AGI Hunt
产品应用7

快手提出强化学习创新框架RLEP,突破模型推理瓶颈

OpenAI等模型用强化学习提升推理能力,但面临训练不稳定等挑战。快手Klear团队提出RLEP框架,引入经验回放技术,分经验收集和回放训练两阶段,还采用优化策略,提升模型训练效率和性能。

AIGC开放社区
开源动态8

文心模型 4.5 系列正式开源,涵盖 10 余款模型

6月30日,百度正式开源文心模型4.5系列,含10款模型,实现预训练权重和推理代码全开源。可在飞桨星河社区等平台下载,百度实现框架与模型“双层开源”,技术创新多,性能表现优。

AI前线
算法论文8

模型“吃一堑长一智”,南理工百度等提出模型记忆新方法

南京理工学联合百度等提出新方法ViLoMem,构建视觉流+逻辑流的双流语义记忆,让模型“从错误学习”。它能在多模态基准提升模型表现,强模型记忆还可迁移给小模型。

量子位
新闻资讯7

腾讯组织调整,前 OpenAI 研究员姚顺雨担任首席 AI 学家

腾讯进行组织架构调整,成立AI Infra部等部门。前OpenAI研究员姚顺雨出任首席AI学家,兼任多职。此次调整旨在整合模型、数据、算力,腾讯还力招募人才,此前元宝借开源起量,凸显自研重要性。

MacTalk
新闻资讯8

千丁数魏振华:企业AI落地“六步法”|甲子引力

2025年12月3日,千丁数COO兼首席学家魏振华在甲子引力年终盛典上,结合龙湖数字化沉淀与实践,复盘企业AI落地。他提出“六步法”,并展示六场景数据,为传统行业智能化转型提供参考。

甲子光年