「多角色架构」共找到 5596 篇相关文章
英伟达笑到最后!训练2000步,1.5B逆袭7B巨兽,Scaling真来了
英伟达团队提出ProRL训练法,将强化学习扩展到超2000步。用此方法训练的15亿参数模型媲美70亿参数的Deepseek - R1 - 7B,在多任务中表现出色,解决了熵崩溃和训练不稳定问题。
PaddleOCR3.0全面开源!文档解析PP-StructureV3:PDF秒变高质量结构化文件!
在大模型与RAG技术发展下,结构化数据愈发重要。飞桨团队打造PP - StructureV3并随PaddleOCR3.0全面开源,它能将文档精准转为结构化文件,有精度高、能力多等优势,还介绍了使用方式。
AI最尴尬的短板,中国科学院出手了
7月24日,中科院计算所“知境”团队发布知境社会心智大模型技术体系,为现有大模型补社会心智短板。其建评测体系SoMBench,设计训练系统Zing,用部署架构Actio,在多评测超越GPT - 5.5等,应用前景广。
人手一个数据库,Kimi背后这套AI基建到底有多能扛?
Kimi K2.6的Agent模式可帮用户搭建全套齐备的网站,但工程算力挑战大。传统数据库难以承接其需求,Kimi后端选TiDB Cloud,做了三个关键决策。这不是孤立事件,反映行业趋势,TiDB还为Agent补齐运行时基础设施。
大模型化身苏格拉底:通过主动提问挖掘人机协作的深度
微软与南加州大学联合团队研究揭示激发大模型主动提问能力新范式。通过定义主动信息收集任务、提出强化微调策略,经实验验证该方法有效,使模型在多领域表现出色,重新定义大模型角色。
用完这张无限可能的AI画布,第一次感觉人类导演要失业了!
2024年7月上线后迅速风靡海外的SkyReels发布最新版本,它重构AI创作生态,打通「图片—音频—视频」全栈,集成多种功能于一张画布,还推出专家智能体,让普通人轻松创作高质量内容。
小说一键转有声剧!豆包语音团队提出「AI多人有声剧」方案,沉浸感拉满了
豆包语音团队发布「AI 多人有声剧」自动化方案,基于多角色 Seed - TTS - 2.0 模型,实现从小说文本到有声剧成品端到端 AI 制作,成本和周期大降,首批有声剧已在番茄小说 App 上线。
智谱开源GLM-4.5工具调用超越Claude Opus 4.1,成本仅1.4%
开源模型GLM-4.5在伯克利工具使用榜单上超越Claude Opus 4.1,运行相同任务成本仅为1.4%。它采用MoE架构,在多场景表现卓越,推理速度快,成本低,还接入多款主流编程工具。
马斯克终于成『AI No.1』,6大案例看实力与水分
马斯克发布Grok 4,宣称其超越OpenAI等LLM。它屠了各种榜单,但Grok系列口碑欠佳。文中通过多案例测试,展现其在各方面的表现,如编码、数学、图像等,还提到了API速度和价格。
Claude 4 核心成员访谈:提升 Agent 独立工作能力,强化模型长程任务能力是关键
Anthropic 两位研究员在采访中表示 2025 年强化学习在大语言模型训练奏效,如 Opus 4 能处理长周期任务。还探讨模型发展方向,如用户与多模型交互、模型可解释性等,认为未来会有白领 AI 员工。