「多LLM系统」共找到 6002 篇相关文章
前端工程化演进之路:从手工作坊到AI驱动的智能化开发
本文回顾前端开发从jQuery到AI的变革,剖析工程化演进、性能优化进化,展示AI与前端深度融合新范式。还预测未来趋势,为开发者提供成长路径指导,强调工程化、性能优化、AI应用及持续学习的重要性。
刚刚,美团开源 SOTA 推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking
美团宣布开源高效推理模型 LongCat-Flash-Thinking,性能逼近 GPT5-Thinking,是国内首个结合多种推理能力的大语言模型。它采用新方法提升性能,已在多平台开源,API 平台免费开放,还兼容主流 API 格式。
陶哲轩官宣AI数学基金首轮名单:29个项目瓜分1.3亿,数学界沸腾!
陶哲轩担任顾问的AI数学基金公布首批获资助项目,因提案质量高,资助金额从900万美元翻倍至1800万美元。首轮29个项目来自多所名校,单个项目最高获100万美元,旨在推动数学与AI结合。
刚刚,GPT-5 横扫编程奥林匹克,5 小时打穿 12 题!人类最强队伍只能做出11道
2025年国际大学编程竞赛世界总决赛(ICPC)上,GPT - 5和OpenAI实验推理模型5小时解完12道题,超越人类最强队伍。Google DeepMind的Gemini 2.5 Deep Think获10/12。此成绩展示推理系统惊人进步。
Qwen3-Next:迈向更极致的训练推理性价比
文章发布Qwen3-Next架构及Qwen3-Next-80B-A3B系列模型,通过混合注意力等改进提升训练推理效率。介绍模型结构、性能优势,还说明使用方法,包括在多平台部署及处理超长上下文,展望持续优化架构。
苹果不吹 AI,反而成功了?
北京时间9月10日苹果发布会,与iPhone 16发布时大肆宣传AI不同,此次重点在硬件及AI幕后支持。此前苹果对AI宣传过度致部分功能未推出引失望,且在智能体AI助手进展落后。多数人不因AI换机,给了苹果试错时间,但它在AI竞赛中落后,中国厂商布局更快。
高性能计算群星闪耀时
本文介绍了高性能计算(HPC)在大模型时代的重要性,以及清华高性能计算团队在HPC及相关领域的研究与实践。如郑纬民带领团队突破存储技术,陈文光、翟季冬等助力大模型训练,武永卫团队优化推理,张悠慧探索类脑计算。
Anthropic 完成930亿元 F 轮融资,投后估值达 13096亿
Anthropic 宣布完成由 ICONIQ 领投的 130 亿美元 F 轮融资,投后估值达 1830 亿美元。众多顶级投资机构参与,自推出 Claude 模型后增长飞速,业务覆盖多领域,资金将用于扩产、安全研究和国际化。
最新研究揭示视觉模型与人脑的对齐机制
FAIR与巴黎高等师范学院通过训练自监督视觉Transformer模型(DINOv3),评估脑 - 模型相似性。发现模型大小、训练数据量和图像类型影响相似度,DINOv3学到的表征会逐步与人脑一致。
数据科学新风口?三大环节搞定ML「资产」管理,VLDB'25最新教程抢先看!
大模型时代,ML资产爆炸式增长,但大多缺乏规范管理。凯斯西储大学等研究团队将在VLDB 2025提出教程,从整理、发现、利用三大环节给出ML资产管理方法论与系统路径,还会展示前沿平台解决实际问题。