「多角色架构」共找到 5568 篇相关文章
通义实验室新研究:大模型自己「扮演」搜索引擎,提升推理能力无需搜索API
阿里通义实验室开源ZeroSearch,提供无需与真实搜索引擎交互的强化学习框架。它用模拟搜索环境和渐进式抗噪训练,让LLM自给自足,节省API成本,在多问答数据集表现优,为智能化检索提供新思路。
GLM-5.3你来定!智谱唐杰全球征集意见,评论区清一色:视觉
清华教授、智谱唐杰在𝕏征集GLM下个版本意见,浏览量达40w+。此前他有求必应,网友热情参与。这次评论区多要视觉能力,因GLM-5.2是纯文本模型,而对手多为多模态。
0.7nm制程芯片问世!摩尔定律又活了
IBM推出全球首款0.7纳米芯片制程节点,指甲盖大小芯片可集成近1000亿晶体管,性能或能效大幅提升。靠‘纳米堆叠’架构实现突破,最早5年内量产,有望让芯片微缩延续十年。
高潮从第几秒开始?GaMMA 让多模态大模型真正「听懂」音乐时间线
现有多模态大模型难以理解音乐时间线。复旦大学与字节跳动团队提出 GaMMA,采用双编码器融合网络,经三阶段训练,还推出 MusicBench 评测基准。实验显示,GaMMA 在多基准上表现优异,刷新 SOTA。
π0.7发布,VLA押出了机器人的GPT-3时刻
今天凌晨,Physical Intelligence发布VLA模型π0.7,首次在机器人领域证明组合泛化。它用多样化prompt处理多样数据,涌现多种能力,还证明数据过滤可能是伪问题,架构基于前作,推动VLA回归。
除了AGI已来和死亡,我们为黄仁勋重磅访谈总结了50条AI最前沿判断
2026年3月23日黄仁勋在播客访谈提出众多前沿判断,如AGI已来,Agent时代开启;智能会成商品,人性才稀缺;推理成本高;合成数据非旁门左道等,还谈及公司架构、算力、供应链等话题。
字节跳动开源视频生成模型Alive:12B参数,个人电脑也能跑
字节跳动开源视频生成模型Alive,12B参数,支持四种模式,硬件门槛低。在评测中表现出色,技术架构精心设计,解决音视频同步等问题,虽有小瑕疵,但更适合普通玩家。
「听觉」引导「视觉」,OmniAgent开启全模态主动感知新范式
针对端到端全模态大模型痛点,浙江大学、西湖大学、蚂蚁集团联合提出 OmniAgent,它基于「音频引导」,用「思考 - 行动 - 观察 - 反思」闭环实现范式转变,在多基准测试中超越开闭源模型。
拯救大模型的逻辑短板:Nature文章预测符号主义AI与神经网络的联姻将引爆下一场技术革命
结合逻辑系统与神经网络成AI热门趋势,神经符号AI崛起,旨在弥补神经网络短板。虽面临技术挑战,但已在多领域展现潜力,不过也有质疑声,其发展仍面临诸多难题。
整体工程:有机解决复杂演进系统中的问题
软件开发中项目延期、架构偏离等问题,常由非技术力量导致。整体工程将这些力量纳入技术决策,能解决复杂演进系统问题,还介绍了实践方法及好处。