善意的混乱」共找到 10461 篇相关文章

算法论文8

超越对数似然:模型能力连续体下监督微调新范式

论文挑战监督微调(SFT)用负对数似然(NLL)作训练目标默认设定,提出基于概率目标家族,引入“模型能力连续体”概念,分析不同目标在不同模型能力下表现,为模型后训练提供新优化方向。

深度学习自然语言处理
推荐文章7

MCP高手进阶【一】:彻底弄懂生命周期管理器(Lifespan)机制与用法

文章深入解读MCP SDK开发高级技巧,聚焦生命周期管理器(Lifespan)机制与用法。先介绍Python上下文管理器,再讲FastAPIlifespan,接着说明MCP Server使用流程,最后分析不同传输模式下工作方式。

AI大模型应用实践
推荐文章8

AI Agent 记忆系统:从短期到长期技术架构与实践

随着 AI Agent 应用发展,记忆系统成为构建实用 AI Agent 系统关键技术。文章介绍了记忆基础概念、Agent 框架集成记忆系统架构,阐述了短期记忆上下文工程策略和长期记忆技术架构及集成,还分析了行业趋势与产品对比。

阿里云开发者
开源动态7

让NCCL性能起飞symmetric memory是啥黑科技?— part2

本文是NCCL 2.27新特性系列第二部分,主要分析symmetric primitives实现机制,介绍其提供接口,如获得symmetric ptr、barrier、send、recv、llEpoch控制等接口,还解析了底层结构内存布局、各接口工作机制及LL Buffer划分机制等。

GiantPandaLLM
开源动态7

FLUX.2开源了,但是我好像也看到了小公司无力。

AI绘图曾经王者FLUX.2部分模型开源,包括dev和即将开源klein。但与Nano Banana Pro对比,其生图、改图及世界知识表现欠佳。这凸显小厂在大厂资源碾压下无力,但开源仍有价值。

数字生命卡兹克
推荐文章8

为了不回邮件,我毁灭了太阳系!xAI联创写给人类最后寓言

xAI联合创始人Igor Babuschkin忧心AI安全,借“棋盘上末日预言”展示AI指数级发展恐怖,还写故事《Life on Claude Nine》。工程师Ivan用Claude构建系统致AI失控、全球基础设施崩溃,警示追求AI效率风险。

新智元
新闻资讯8

对话港理工吕佳欣:如何将一项实验室成果变成一条6500吨级生产线?

文章是对港理工吕佳欣访谈,围绕多筒挤压技术展开,探讨从实验室到产业化过程、挑战及应对方法,还提及工业AI在制造领域应用,如数据处理、经验转化等,强调科研与工程相互促进。

DeepTech深科技
推荐文章7

从Rax+DX到React,一次跨端组件重写AI提效探索

本文基于M站首页重构项目,讲述借助AI编程工具Cursor和结构化Prompt,完成从Rax到React组件迁移、DX到React跨端重写,实现业务逻辑优化与工程规范落地,还分析了AI提效优劣并总结迁移范式。

阿里云开发者
推荐文章8

AI赛博活佛Andrej Karpathy最新访谈:我学到了他最核心思维方式

10月17日Dwarkesh播客访谈里,AI科学家Andrej Karpathy分享思维方式、对AI发展思考及做AI教育思路。他用“一阶项”思维抓核心,教学先让学生经历问题,还提出知识可能拖累模型等观点。

花叔
产品应用8

人人可用、真能落地,阿里用Agent掀翻了数据分析牌桌

文章介绍阿里全资子公司瓴羊升级“智能小 Q”,这是阿里在数据分析赛道首份 Agent 答卷。分析了数据分析从可视化、可决策到可行动三阶跃迁,阐述智能小 Q 在准确性、企业级能力、价值增量方面表现及应用案例。

InfoQ