「数字人框架」共找到 2913 篇相关文章
SIGGRAPH 2025奖项出炉:上科大、厦大入选最佳论文
本周三,全球图形学顶级会议 SIGGRAPH 公开今年论文奖项。该会议影响力高,涵盖动画、生成式人工智能等多领域。今年有上科大、厦大等校论文入选最佳,还有时间检验奖等,涉及动力学框架等研究。
MMAR与AudioTrust技术解读,音频大模型评测前沿进展分享 | AI Bench Talk直播预告
司南评测集社区 CompassHub 收录多维度评测集。此次 AI Bench Talk 直播聚焦音频大模型,将分享评估其深度推理能力的 MMAR 及全方位可信评估框架 AudioTrust,还设圆桌讨论多模态/音频大模型相关议题。
字节Seed新作:模型合并如何改变大模型预训练范式
字节跳动Seed团队在arXiv发表论文,提出预训练模型平均(PMA)技术。该技术将模型合并引入预训练阶段,可提升性能、预测衰减阶段表现,还能解决训练问题。不过,高学习率影响和强化学习应用待研究。
面向多工具任务调度的两种路径:MCP vs Agent + Function call
本文围绕大语言模型智能应用中的工具与数据接入问题,介绍了基于 Agent + Function Call 的动态调度机制与基于 MCP 的标准化接入框架,分析了不同场景下的适用性,还探讨了二者未来的协同融合方向。
Spring AI 实战|Spring AI入门之DeepSeek调用
文章介绍Spring AI框架,它简化企业数据或API服务与大模型集成,降低开发复杂度。还给出调用DeepSeek的实战步骤,包括手动请求、代码自动发起、实现流式响应等,也提及OpenAI starter的兼容性及生产环境监控。
微软开源浏览器Agent,可实时跟踪、控制智能体,超4000颗星
微软在官网开源用于浏览器网络任务的Agent——Magentic - UI,基于Magentic - One开发,支持人机协同。GAIA测试显示其能提升任务完成率和准确率。它以人为本,有独特机制,框架含多阶段,在Github超4000颗星,支持MIT许可证商用。
伯牙智能创始人兼CEO刘欣:灵巧手重塑具身智能|甲子引力X
2024年4月28日,「AI共潮生—2025甲子引力X科技产业新风向」大会举办。伯牙智能CEO刘欣分享称,AI在物理世界赋能需灵巧手,其操作发展尚处初期,有软硬件挑战,还提出对数据及触觉传感能力的新思考。
Hugging Face开源nanoVLM,750行代码可训练视觉语言模型,简单到令人发指!
Hugging Face开源全新视觉语言模型框架nanoVLM,仅750行代码就能从零训练高效能VLM模型。它在单张H100 GPU训练6小时后,在MMStar数据集准确率达35.3%,且能在免费Google Colab跑。
AI引爆全球失业潮,美国大学生毕业即失业!全球大厂联手裁员上万
新智元报道,AI已引爆全球失业潮,多邻国等全球五家大企业因AI裁员上万人,美国大学毕业生失业率高达5.8%。企业为削减成本用AI取代人力,这不仅是技术革新,更是职场地震,改变了劳动力市场。
Claude深夜更新!DeepResearch+MCP入侵你的私人数据,威力很大!
Anthropic宣布Claude的「Integrations」集成功能和「Advanced Research」高级研究能力两项更新,改变人与AI交互方式。集成功能可连接多种应用,高级研究能力增强了搜索研究能力,这些更新标志着AI助手向工作伙伴转变。