「数据驱动代理模型」共找到 3125 篇相关文章
Generalist最新长文定调:具身原生才是正道,中国玩家原力灵机已交卷
Generalist创始人Pete Florence团队释出GEN-1技术博客,否定世界模型与VLA之争,强调具身智能应回归目标,主张从零训练。中国原力灵机DM0也采用具身原生路线,在RoboChallenge评测中成绩优异。
小米AI语音新框架:人人都能当声音导演
小米大模型应用团队提出Midasheng - audio - generate与Xiaomi Any2Speech两大音频生成框架。前者可实现全场景声音重建,后者让AI学会理解声学空间与叙事逻辑,改变了语音合成应用场景与思路。
3个工程师、0融资、不开会,估值3.5亿美元的Obsidian才是真正的「小而美」
Obsidian 作为全球最具影响力的本地化 Markdown 笔记应用之一,估值 3.5 亿美元,但仅 7 人全职团队。它拒绝资本,靠用户付费运营,有「无会议文化」,底层插件系统强大,和 Notion 信息管理哲学不同。
作业帮StarRocks替换Presto落地实践
本文分享作业帮 2025 年 StarRocks 替换 Presto 的实践,涵盖历史背景、技术方案、双跑方案、结果分析,还提及核心问题及解决办法,项目上线后在资源、架构、性能上均有收益,也有未来规划。
世界模型原生新一代范式!极佳视界斩获全球第一后,GigaBrain-0.5M*再进化
具身世界模型新一代原生范式登场,GigaBrain-0.5M*在多真实机器人任务中数小时零失误。它依托世界模型,创新引入人在回路机制,研发采用四阶段闭环训练流程,优势显著。
Anthropic 2026 Agentic Coding 趋势报告:软件开发的 8 大变革
Anthropic《2026 Agentic Coding Trends Report》基于企业实战数据,总结了AI编程Agent重塑软件开发的8大趋势,分基础、能力、影响三类,附企业案例,还给出2026年四大优先事项。
ICLR 2026 | 异常需要定义!中传团队提出开放世界视频异常检测新范式
现有视频异常检测(VAD)方法泛化能力不足,无法适应开放世界需求。中传吴晓雨团队在ICLR 2026发表论文,提出LaGoVAD模型,联合建模视频与异常定义,解决样本密度下降等问题,实验显示泛化性强。
100 刀订阅的 Claude Cowork,被 GitHub 大神 2 天手搓出「开源升级版」!
Anthropic 的 Claude Cowork 功能强大,但昂贵门槛挡住多数人。开源社区的 Accomplish,开发者 2 天就搓出其开源平替版,还是升级版,能本地运行、支持多模型。
智能必须基于世界模型?我们和蚂蚁灵波团队聊了聊
上周图灵奖得主 Yann LeCun 认为真正的智能应能在脑海推演,而大语言模型难以触及真实世界。2026 年初,蚂蚁灵波连续四天开源四款具身智能模型,探索从物理交互构建智能的新路径。
多模态文本智能白皮书发布!5大能力标准、11个行业案例全解析(附下载)
合合信息发布《文本价值觉醒,赋能智能决策——多模态大模型文本智能白皮书(2026)》,提出复杂文本智能五大核心能力标准,还通过11个真实行业标杆案例展示技术如何转化文档为决策力。