「多人数据采集」共找到 4211 篇相关文章
大树之家团队师生赴希腊参加第一届人工智能与流体力学国际研讨会(AIFLUIDs)
第1届人工智能与流体力学国际研讨会于2025年5月27 - 30日在希腊举办,由多所高校联合筹办,34国超300名学者和近20家科技公司参会。大树之家团队8人参与,作报告获高度关注,加强了学术交流。
AI生图迎来大升级:图像编辑达到像素级!背后团队大多来自Stable Diffusion模型基础技术发明团队
Stable Diffusion缔造者团队创立的 BFL 发布全新图像生成模型 FLUX.1 Kontext,可实现像素级图像编辑。它能以文本和图像为输入,有 Pro、Max、Dev 三版本,已在多平台上线,获用户好评,但也面临竞争。
AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号
UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在多任务表现良好。
微软开源浏览器Agent,可实时跟踪、控制智能体,超4000颗星
微软在官网开源用于浏览器网络任务的Agent——Magentic - UI,基于Magentic - One开发,支持人机协同。GAIA测试显示其能提升任务完成率和准确率。它以人为本,有独特机制,框架含多阶段,在Github超4000颗星,支持MIT许可证商用。
叶子豪、陈天奇等人开源项目FlashInfer入选,MLSys2025最佳论文奖公布
近日,MLSys 2025公布最佳论文奖,FlashInfer等入选。FlashInfer由多机构合作发起,是灵活的LLM推理内核库,优化内存访问、有可定制模板和调度机制,性能提升显著。另一获奖论文提出Negativa - ML可消除ML框架臃肿。
专业医生远不如AI模型?OpenAI推出医疗开源测试基准HealthBench,o3表现最强
OpenAI推出医疗开源测试基准HealthBench,由262位多国医生合作打造,含5000段真实健康对话。评估显示o3综合表现最佳,顶尖AI处理任务能力超无辅助医生,HealthBench更真实专业有区分度,但也有局限。
17000字Claude 系统提示启示:Karpathy 揭秘LLM 学习缺失“第三范式”
Andrej Karpathy提出LLM学习范式缺失‘系统提示词学习’环节。他观察Claude约17000词的系统提示词,认为目前问题解决策略多靠人工写入,理想情况应通过该学习产生,这也引出诸多待明确细节和新问题。
超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光
英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。
AI教父Hinton警告:有志于编程,不必读大学!
新智元报道,AI教父Hinton等警告AI正在颠覆编程岗位,美国超1/4编程职位已消失。探讨大学是否还应教编程、CS是否值得学,还提及程序员求职难等现状及未来技能需求趋势。
DeepSeek Harness背后的“心脏”:Cordis 到底是什么
文章介绍Cordis框架,它原服务第三方QQ机器人,现是DeepSeek Harness心脏。阐述其设计初衷、核心机制,如插件、上下文等概念,还提及在DSH中的应用,展示了插件槽位和生态,最后介绍相关论文和该框架的生态情况。