「展会亮点」共找到 1730 篇相关文章
数据科学新风口?三大环节搞定ML「资产」管理,VLDB'25最新教程抢先看!
大模型时代,ML资产爆炸式增长,但大多缺乏规范管理。凯斯西储大学等研究团队将在VLDB 2025提出教程,从整理、发现、利用三大环节给出ML资产管理方法论与系统路径,还会展示前沿平台解决实际问题。
华人团队终结Token危机:扩散模型数据潜力超自回归三倍
最新研究发现,token数量受限下,扩散语言模型数据潜力超自回归模型三倍多。一个1B参数的扩散模型用1B tokens训练,在基准测试取得不错准确率,且未现性能饱和。
万亿参数狂欢!一文刷爆2025年七大顶流大模型架构
文章深入剖析2025年顶级开源模型的创新技术,介绍了DeepSeek V3/R1、Kimi 2、Qwen3等七大顶流大模型架构,揭示滑动窗口注意力、MoE和NoPE如何重塑效率与性能。
Kimi K2官方技术报告出炉:采用384个专家,训练不靠刷题靠“用自己的话再讲一遍”
Kimi K2官方技术报告公开称霸全球开源模型的秘籍,介绍其训练过程及“秘密配方”,包括MuonClip优化器、大规模Agentic Tool Use数据合成等技术亮点,还提及后阿里通义Qwen3更新击败Kimi K2。
1万tokens是检验长文本的新基准,超过后18款大模型集体失智
Chroma团队研究发现,将上下文扩展至1万tokens,18款主流大模型集体“失智”,“智商”非均匀下降,在一些节点会断崖式下跌。研究还设计四项对照实验,证明LLMs性能随输入长度增加显著且非均匀下降。
黄仁勋中国现场直击!假如有一个「数字黄仁勋」,我希望我们一起变聪明
英伟达CEO黄仁勋再访北京,接受新智元等媒体采访。他盛赞华为优秀,评价DeepSeek等模型出色,还谈及AGI、数字分身、出口管制等话题。此外,H20芯片解禁重售释放政策信号,有望实现中美科技企业合作共赢。
B站下场自研AI配音!纯正美音版甄嬛传流出,再不用看小红书学英语了(Doge)
B站发布TTS模型IndexTTS2,亮点是实现时长控制时再现符合Prompt的情感特征,支持两种生成方式,经测试多项指标达SOTA。它由三核心模块组成,还可能是代号H的AI创作工具一环。
模型即 Agent 的含金量:Kimi深度研究功能详评
作者分享Kimi深度研究功能体验。其基于端到端自主强化学习技术,会开源模型。在测试中,分析Labubu爆火原因、检索小米发布会内容,展现出强逻辑分析、搜索准确性和数据处理能力,可视化网页也出色。
GPT-5今夏突袭?Sam Altman 首次大谈 GPT-5、AGI
OpenAI联合创始人兼CEO Sam Altman接受40分钟深度专访,谈到GPT - 5大概率今夏发布,也会因多种原因延期,还提及o3、Deep Research等产品对实现AGI的重要性,以及OpenAI其他创新产品、项目和发展规划等。
AMD发布旗舰AI芯片,称性能比肩英伟达
当地时间6月12日,AMD CEO苏姿丰在大会展示多款AI新品,将新AI芯片与英伟达同类产品对比,称性能比肩且性价比高。还展示了新软件栈、介绍下一代AI机架产品,预计推理成未来AI发展主驱动力。