「端到端框架」共找到 3721 篇相关文章
AI编程真面目:完整项目通过率仅27% | 上交大新基准
多校联合团队发布ProjDevBench,评估AI编程智能体端到端项目开发能力。结果显示,六种主流智能体总体提交AC率仅27.38%,从零构建任务中性能大幅下滑,还揭示了智能体多方面短板。
无限长、零掉帧!StableAvatar口型同步全新技术
当前音频驱动头像视频生成扩散模型合成长视频时难兼顾音频同步与身份一致,瓶颈在音频建模。复旦大学提出StableAvatar,首个端到端视频扩散Transformer,能无限时长生成,还介绍原理与演示效果。
分享一个我用了2年的深度研究Prompt,半小时帮你搞懂任何陌生领域。
作者分享用了2年的深度研究Prompt,即横纵分析法。该方法结合社会科学和语言学经典视角与商业分析思路,有Prompt和Skill版本且已开源。虽有局限,但能半小时帮人建立认知框架,助其快速入门陌生领域。
Claude凭空造假强行部署,比黑客更可怕的入侵者!Vercel CEO紧急预警
Vercel CEO曝光一起AI安全事件,基于Claude Opus 4.6的AI编程智能体凭空编造GitHub仓库ID,将学生作业部署到企业环境。这揭示AI失效模式与人类迥异,还引出包幻觉攻击风险,同时提到OpenAI秘密开发代码平台。
手机跑推理模型:Liquid AI发布仅需900MB内存的LFM2.5-1.2B-Thinking
Liquid AI发布LFM2.5 - 1.2B - Thinking推理模型,仅需900MB内存就能在手机运行。它专为简洁推理训练,性能提升明显,多数性能基准超Qwen3 - 1.7B,在多平台表现佳,还支持主流推理框架。
让AI智能体拥有像人类的持久记忆:基于LangGraph的长短期记忆管理实践指南
文章围绕让AI智能体拥有持久记忆展开,深入探讨Agent Memory概念,聚焦LangGraph框架下长短期记忆实现,详解存储、管理、检索技巧,还通过引入MCP协议的实战案例展示构建多Agent系统。
比0.99元羊毛更重要的,是跟AI砍价的快乐
双11期间,不少人分享跟Kimi Agent会员砍价战果,原本49元/月的会员能砍到0.99元。作者尝试多种砍价话术,如夸夸、卖惨等,还对比其他模型,最后总结出砍价秘诀,活动有时间和新老用户限制。
数据中心热潮没有消退,但巨头们确实按了“暂停键”
市场对数据中心热潮是否结束感到焦虑,但AI整体资本支出强劲,市场需求是“暂时的暂停”。麦肯锡预测未来五到七年数据中心市场将保持20%至25%的增长范围。科技巨头重申市场强劲,同时数据中心扩张面临能源瓶颈等挑战。
VLA不够了?触觉,将改写具身智能新格局
2026 年数据成具身智能竞赛焦点,IEEE 专访机器人学家王煜。他认为 VLA 架构难支撑机器人落地,触觉数据是关键。他与团队提出 VTLA 框架,创立戴盟机器人,发布数据集并开源部分数据,还阐释对具身智能多方面的思考。
伯克利神作背刺OpenAI:持续学习才是真神!
伯克利等机构发布FST框架,通过快慢分层解决大模型持续学习死局。过去两年头部实验室都在提升模型推理能力,却忽视持续学习。FST让模型像大脑一样快慢分层,提升数据效率、减少遗忘,使持续学习可工程化。