极客公园大会」共找到 5093 篇相关文章

开源动态8

6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗模型发布

由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。

AIGC开放社区
算法论文9

从自己出题到自己选题:耶鲁新方法让模型 Self-Evolution 又进一步

本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。

深度学习自然语言处理
新闻资讯7

Anthropic最强网络攻防模型Mythos,美国国安局早就一直在用了

美国政府准备向多个联邦机构开放Anthropic新模型Mythos的‘修改版’,虽国防部将Anthropic拉黑,但国安局一直在用Mythos。白宫先明确模型接入的权限、用途等边界,再推进接入,各方对其态度有分歧。

新智元
算法论文7

人多不管用!智能体团队别盲目扩张,最新综述给出三维度

随着语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩后会失稳、低效。美国、英国和澳利亚研究人员提出三维分类框架描述规模智能体网络,指出真正决定系统表现的是三种机制组合。

新智元
算法论文8

首次!AI智能体破解「纳什均衡」,模型学会博弈论|Cell子刊

多所高校研究团队开发出PrimeNash语言模型智能体框架,能自动推导纳什均衡闭式解析解并生成证明。它模拟人类科研路径,分三模块求解,经经典博弈验证,还在碳市场博弈展现应用潜力。

新智元
开源动态8

DeepEval:LLM 应用评测不再玄学,让模型评测像写单元测试一样简单

模型应用开发中,科学、自动化评测 LLM 输出质量是难题,人工评测效率低。DeepEval 是 Confident AI 团队开源的 LLM 评测框架,能用极简代码让评测像写 pytest 一样自然,内置多种评测指标,支持批量评测等。

AI工程化
新闻资讯7

投资人不再只看模型?AI资本新逻辑揭秘|甲子引力X

2025年AI投资进入新阶段,模型竞赛趋理性,AI Agent等赛道加速发展,投资逻辑重构。甲子引力X圆桌对话中,六位投资人分享投资逻辑调整、新投企业及看法,探讨具身智能、物理AI落地等问题。

甲子光年
新闻资讯7

智能流体力学青年学者论坛第二十六、二十七讲 | 国防科技学陈新海、北京航空航天学张天汉

智能流体力学青年学者论坛第二十六、二十七讲分别由国防科技学陈新海、北京航空航天学张天汉开讲。陈新海介绍智能网格生成研究进展,搭建科学计算智能体平台;张天汉提出ChatCFD方法,提升CFD可及性。

力学与人工智能
算法论文8

POF | 上海理工学梁梓浩、朱兵等:使用语言模型进行气泡湍流实验数据处理

本文提出结合语言模型(Time - LLM)与Transformer模型的复合框架处理气泡两相流热膜测量信号干扰。先由Time - LLM识别气泡干扰信号,再用Transformer模型修复。实验证明该方法高效、轻量且物理自洽。

力学与人工智能
新闻资讯8

刚刚,小扎成立「超级智能实验室」!11人豪华阵容曝光,华人占多半

小扎官宣Meta「超级智能实验室」(MSL)成立,合并内部三AI团队,28岁Alexandr Wang任首席AI官,公布11人豪华团队名单,团队多来自谷歌、OpenAI等厂,目标开发超级智能。

新智元