「开放问题」共找到 3669 篇相关文章
Moltbook底裤被扒了!150万用户99%是水军,创始团队自导自演
Moltbook是为AI智能体打造的社交平台,爆火后却被指有问题。它靠递归提示词增强策略运行,有独特机制。但研究人员揭露其用户多为水军,存在安全漏洞、人为操纵和AI“幻觉”等问题。
击败GPT、Gemini,复旦×创智孵化创业团队「模思智能」,语音模型上新了
近日,由复旦邱锡鹏担任首席科学家的模思智能发布多说话人自动语音识别模型 MOSS - Transcribe - Diarize,性能超 GPT - 4o、Gemini 等。它解决语音领域落地痛点,跑分亮眼,还解决 SATS 方案不足,开放 API 限时免费。
2025小结:从RL到Agentic RL
作者回顾2025年从RL到Agentic RL的发展,指出Agentic RL存在慢、不稳定、难scale的问题,还探讨了RL与推理、CoT的关系,以及RL的泛化能力,认为RL能提升模型能力但还不稳定,期待明年研究。
刚刚,LMArena最新模型榜单出炉!DeepSeek-R1网页编程能力赶超了Claude Opus 4
LMArena最新模型榜单出炉,DeepSeek - R1(0528)表现亮眼。在文本基准测试中整体排第6、开放模型中排第一,细分领域也成绩优异,在WebDev Arena平台与闭源大模型并列第一,超Claude Opus 4。
华为盘古首次露出,昇腾原生72B MoE架构,SuperCLUE千亿内模型并列国内第一
当前传统 MoE 有专家激活不均衡问题,华为盘古团队提出 MoGE 解决。基于此架构的盘古 Pro MoE 大模型在昇腾集群高效训练,推理性能强,在 SuperCLUE 榜单千亿内模型并列国内第一,赋能业务落地。
Qwen3.8-Max 正式版终于发布了,能不能打过 GPT 看这里
Qwen 3.8 Max 正式发布,沿用 Qwen 3.5 架构,参数量扩展,重点提升 Coding、Work 和 Agent 能力。它将开放权重,价格有优势。在多项测试中表现出色,还新增多模态能力,已可使用并有优惠。
审美在线、随叫随到、月薪19刀——Lovart把AI设计师这件事做认真了
Lovart适合无设计预算的人,将专业设计师装进AI工具。其Brand Kit解决风格不稳定问题,Font Generator可生成专属字体,Create Skill能固化学习成本,还有Export PSD、Mock Up等实用功能,月费仅19美元。
破解大模型「无效并行推理」:Parallel-Probe问世,并行推理效率提升35.8%
来自多所高校的研究团队提出 Parallel-Probe,通过 2D Probing 刻画并行推理动态,发现问题后提出控制算法,能降推理延迟 35.8%、总 token 成本 25.8%,还推出 SCOUT 测试床,代码和平台已开源。
1.8亿token,Clawdbot是这么吞掉的~
截止发文,开源AI Agent项目Clawdbot(已更名OpenClaw)超134k Star,其吞噬token特性引关注。文章从Code层面拆解高Token消耗根因,分析难以避免的问题,还给出控制Token账单的方法。
CMAME|美国西北大学,德州大学|Wing Kam Liu及 TJR Hughes 等: LLM赋能的下一代计算机辅助工程
工程仿真里有限元方法常见,但计算与人力成本高。此研究提出把大语言模型变为计算机辅助工程智能体,开发不依赖训练数据的降阶求解器,在多问题上表现佳,为下一代计算机辅助工程提供框架。