「超级智能体」共找到 5741 篇相关文章
Fable 5榜单第一靠作弊?代码泄露,模型真实身份曝光
黑客泄露Claude Fable 5长达12万字符的系统提示词,揭示它并非大模型,而是伪装成LLM的完整Agent系统。这颠覆了对AI模型的认知,也让Anthropic陷入舆论漩涡,还暴露了其计费黑幕。
高潮从第几秒开始?GaMMA 让多模态大模型真正「听懂」音乐时间线
现有多模态大模型难以理解音乐时间线。复旦大学与字节跳动团队提出 GaMMA,采用双编码器融合网络,经三阶段训练,还推出 MusicBench 评测基准。实验显示,GaMMA 在多基准上表现优异,刷新 SOTA。
一个用户名查遍 3000+ 网站,这款开源 OSINT 神器实测解析
文章介绍开源 OSINT 工具 Maigret,只需一个用户名,它能查 3000+ 网站,3 分钟出结果,免费且无需 API Key。它有零门槛安装、精准筛选等诸多优势,还给出使用方法和注意事项。
0%完成率!Claude、GPT、Gemini 全灭,SWE-Bench作者新作把AI圈干沉默了
SWE - Bench创建者推出新benchmark ProgramBench,测试AI从零构建软件系统能力。结果一线模型完成率0%,暴露AI擅长局部代码生成,缺全局系统规划能力,引发对其评估方式的讨论。
超越Claude Mythos和GPT-5.5!斯坦福Agent验证框架拿下SOTA,Transformer作者转发
斯坦福、伯克利与英伟达联手打造LLM-as-a-Verifier验证框架,该方法是通用验证机制,可与任意Agent Harness和模型结合。研究表明扩展验证阶段计算量,能提升Agent整体性能,在多基准测试中超越Claude Mythos和GPT - 5.5。
VoxCPM2:无tokenizer语音合成,高保真声音克隆
VoxCPM2突破传统TTS系统局限,直接操作连续声学特征,保留音色纹理更完整。基于扩散自回归架构,有硬核技术指标,提供三种克隆模式,性能佳,生态完善,微调便捷,但也存在安全风险。
732M模型超越7B!机器人操控新范式:从视频中「悟」物理
机器人操控有「数据困境」,传统方法需大量人工标注动作演示数据。中山大学王广润教授团队从视频生成模型「借」物理直觉,提出PAR和PhysGen,与英伟达DreamDojo核心思路一致,验证了新的技术路线。
信息量极大!黄仁勋最新论断:AGI已实现,OpenClaw是AI界iPhone,未来将有10亿程序员
黄仁勋与Lex Fridman深度对谈,分享英伟达发展历程、管理方式、技术趋势等见解。他认为AGI已实现,OpenClaw是Token时代的iPhone,未来将有10亿程序员。还探讨了算力瓶颈、供应链、电力等问题。
安利一个11万Star的必装插件,能让你的Agent体验直接质变。
作者分享超好用的插件Superpowers,它有11万Star,适配多种工具,是指导Agent完成任务的系统。用其开发ADHD阅读器,能规范流程、提升产出质量,让用户少走弯路。
OpenAI 推出“超级应用”,开抢 Anthropic 的企业客户
据《华尔街日报》,OpenAI 计划整合 ChatGPT、Codex 及 Atlas 浏览器为桌面“超级应用”,收缩战线聚焦企业和工程用户场景。Anthropic 也推进贴近桌面工作流产品,双方都在将 AI 往桌面工作流入口方向发展。