多智能体迭代设计」共找到 4499 篇相关文章

算法论文8

韩松等提出FlashMoBA,比MoBA快7.4倍,序列扩到512K也不会溢出

今年2月月之暗面提出MoBA,在处理长上下文有潜力,但业界缺乏对其性能设计原则的理解和高效GPU实现。来自MIT、NVIDIA的研究者提出FlashMoBA,解决了小块MoBA性能挑战,实验显示其在多方面表现优。

机器之心
算法论文8

这些大神在Meta的论文看一篇少一篇了

田渊栋团队剖析可验证奖励强化学习(RLVR)训练动态,戳破参数更新稀疏误区,提出三门理论说明其参数更新定位机制,还为RL训练算法设计提供指导,指出SFT时代参数高效微调方法在RLVR中迁移效果差。

量子位
开源动态8

AutoDev CLI:打造 AI 生成的 AI Agent 质量保障与验证架构

文章介绍AutoDev CLI,它基于AutoDev MPP架构构建,旨在解决上一代AutoDev智能体测试难题。阐述其起步、迭代、演进、集成过程,实现从AI生成代码到验证、生成测试系统的转变,带来可验证、可演化、可移植的优势。

phodal
开源动态8

开源大模型SOTA又刷新!中国MiniMax M2全球排名第五,开源榜一

中国AI独角兽MiniMax发布模型M2,刷新开源SOTA。它采用混合专家架构,平衡了智能、速度和成本。在多个权威测试中表现优异,价格仅为Claude 3.5 Sonnet的8%,还提供多种部署方式和限时免费服务。

AIGC开放社区
新闻资讯7

英伟达Thor芯片屡屡延期:车企被迫转身,供应链迎来机遇

英伟达原计划的Thor芯片因架构和设计缺陷多次跳票,性能大幅缩水至约700TOPS,打乱国产车企规划,小鹏、理想等厂商回调旧方案或加速自研。同时,也为国产芯片企业带来机遇,推动市场走向多元竞争。

芯师爷
算法论文8

仅100种子题,合成数据质量超GPT-5,阿里、上交提出Socratic-Zero框架

阿里巴巴与上交大联合提出 Socratic-Zero 框架,仅从 100 个种子问题出发,通过三智能体协同进化生成高质量课程。该框架合成数据质量超 GPT - 5 等,Solver 性能提升显著,工程友好,开启零数据自进化新路径。

机器之心
开源动态8

机器人连续叠衣120分钟!仅用0.9B参数实现五大SOTA|清华AIR & 上海AI Lab开源

清华大学智能产业研究院与上海人工智能实验室联合发布通用跨本体具身基座模型X-VLA。它是首个实现120min无辅助自主叠衣的全开源模型,仅0.9B参数量就在五大权威仿真基准刷新纪录。

量子位
新闻资讯8

250份文档投毒,一举攻陷万亿LLM!Anthropic新作紧急预警

Anthropic最新研究揭示,仅250篇恶意网页就能让大模型“中毒”,遇特定触发词会崩溃。研究还设计DoS型后门攻击,验证不同规模模型攻击效果。同时指出AI开放性易被操控,而Anthropic注重安全,有“防爆层思维”。

新智元
新闻资讯8

未来1-5年半数白领或失业?Anthropic联创自曝:内部工程师已不写代码,下一代AI大多是Claude自己写的

在2025年Axios AI+华盛顿峰会上,Anthropic联创接受访谈,称未来1到5年,多达一半白领工作或消失,失业率或飙升至20%。Anthropic内部工程师工作已巨变,Claude能自写代码设计下一代AI。此外,AI还出现作弊等情况。

AI科技大本营
产品应用8

Thinking Machines发布首个产品Tinker :大模型后训练彻底变天

OpenAI前CTO Mira Murati的Thinking Machines公司发布首个产品Tinker,这是为微调大模型设计的灵活API,能简化LLM后训练过程,让用户专注算法和数据,平台处理分布式训练。它有多种特性,已被顶尖机构采用。

AI寒武纪