「多Agent体系」共找到 6450 篇相关文章

产品应用8

AI生图迎来大升级:图像编辑达到像素级!背后团队大多来自Stable Diffusion模型基础技术发明团队

Stable Diffusion缔造者团队创立的 BFL 发布全新图像生成模型 FLUX.1 Kontext,可实现像素级图像编辑。它能以文本和图像为输入,有 Pro、Max、Dev 三版本,已在多平台上线,获用户好评,但也面临竞争。

AI前线
产品应用7

一家智能眼镜公司,为什么非要自研AI大模型系统?|甲子光年

智能眼镜要么不够智能,要么不像眼镜,李未可科技CEO茹忆认为AI要成第一响应者。该公司推三款AI眼镜,搭载自研系统。其自研AI大模型系统,是为交付难复制AI体验闭环,解决通用API不足等问题。

甲子光年
算法论文7

AI仅凭“自信”学会推理,浙大校友复刻DeepSeek长思维链涌现,强化学习无需外部奖励信号

UC Berkeley团队提出新训练方法Intuitor,大模型无需接触真实答案,仅优化自身信心就能学会复杂推理。该方法无需外部奖励信号或标注数据,用模型自身置信程度作内在奖励信号,在多任务表现良好。

量子位
开源动态8

红杉中国xbench全球首发,AI智能体真实战力揭榜!

红杉中国推出全新AI基准测试工具xbench及相关论文,采用双轨评估体系和长青评估机制,首期发布两个核心评估集并综合排名,还提出垂类评测方法论。它能追踪模型能力与实际场景价值,解决现有评估难题。

新智元
算法论文8

九成以上模型止步白银段位,只有3个铂金!通用AI下半场评测标准来了

OpenAI研究员姚顺雨提出AI发展步入新阶段,下半场关键在评估模型真实智能。新加坡国立大学等团队提出“通才智能”评测框架,剖析多模态大模型短板,推出五级评估体系和测试集,测试结果暴露模型弱点,引发社区积极反响。

机器之心
开源动态8

叶子豪、陈天奇等人开源项目FlashInfer入选,MLSys2025最佳论文奖公布

近日,MLSys 2025公布最佳论文奖,FlashInfer等入选。FlashInfer由多机构合作发起,是灵活的LLM推理内核库,优化内存访问、有可定制模板和调度机制,性能提升显著。另一获奖论文提出Negativa - ML可消除ML框架臃肿。

机器之心
8

专业医生远不如AI模型?OpenAI推出医疗开源测试基准HealthBench,o3表现最强

OpenAI推出医疗开源测试基准HealthBench,由262位多国医生合作打造,含5000段真实健康对话。评估显示o3综合表现最佳,顶尖AI处理任务能力超无辅助医生,HealthBench更真实专业有区分度,但也有局限。

AI寒武纪
推荐文章7

17000字Claude 系统提示启示:Karpathy 揭秘LLM 学习缺失“第三范式”

Andrej Karpathy提出LLM学习范式缺失‘系统提示词学习’环节。他观察Claude约17000词的系统提示词,认为目前问题解决策略多靠人工写入,理想情况应通过该学习产生,这也引出诸多待明确细节和新问题。

AI寒武纪
开源动态8

超越DeepSeek-R1,英伟达开源新王登顶!14万H100小时训练细节全曝光

英伟达Llama - Nemotron系列模型超越DeepSeek - R1且全部开源。论文揭秘其训练关键,如用合成数据监督微调与强化学习等。还介绍构建阶段、架构设计等,评估显示该系列模型在多任务表现出色。

新智元
新闻资讯8

红杉、云启领投,华超神控完成2亿元Pre-A轮融资,押注「非侵入式AI脑机接口」

本文报道初创公司华超神控完成红杉中国、云启资本领投的2亿元Pre-A轮融资,累计融资近3亿元,介绍其非侵入式AI脑机接口技术路线、研发进展与商业化规划,收录多位投资方观点。

机器之心