「AI 框架」共找到 10650 篇相关文章
让机器人看视频学操作技能,清华等全新发布的CLAP框架做到了
近日,清华联合星尘智能、港大、MIT提出 CLAP 框架,能将视频运动空间与机器人动作空间对齐,解决‘数据饥荒’‘视觉纠缠’等问题,可让机器人从视频学技能,还缓解知识迁移难题,推动机器人产业化。
全员 token-maxxing,一场没人敢停的军备竞赛|五源孟醒 AI 观察
2026年3月底,五源资本合伙人孟醒赴硅谷考察,回国后分享一手观察。当前AI迭代极快,硅谷陷入全员token - maxxing军备竞赛,xAI团队雪崩,工程师和研究员焦虑,英伟达掌控算力,估值体系重写,还出现安全危机。
MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents
MIT和加州联手打造多智能体大语言模型的金融交易框架TradingAgents,将交易任务分解为专业角色,含分析师、研究员等。介绍了安装、CLI使用、包的实现细节等,还提及项目地址。
7个AI玩狼人杀,GPT-5获断崖式MVP,Kimi手段激进
OpenAI总裁转发基准测试,让7个LLMs玩210场狼人杀。GPT - 5胜率96.7%断崖式领先,国产Qwen3和Kimi - K2分列第4、6。测试方分析模型性格,还借此研究LLMs社会行为,长远目标是实现AI驱动的市场研究。
杀死“流水线”: ColaOS(ListenHub)如何构建 AI 时代的液态超级团队 | QCon
4月16 - 18日,QCon全球软件开发大会将在北京举办,聚焦Agentic AI等前沿话题。ColaOS联合创始人徐文健将分享《杀死“流水线”》,复盘ListenHub“任务酒馆”模式,揭示让组织具“液态”创新能力的逻辑。
VeRL-Omni:面向扩散和全模态生成模型的通用RL后训练框架
VeRL-Omni是面向多模态生成模型的通用RL后训练框架,覆盖多种架构。它有高效多模态rollout、灵活奖励引擎等特性,支持多种硬件,团队还验证了不同训练方式,后续将扩展模型与算法支持。
阿里千问落地谷歌UCP+A2UI,中国率先进入AI办事时代
谷歌联合零售巨头发布UCP和A2UI协议,试图定义智能体商务全球标准。而阿里千问App上线千问任务助理1.0,打通淘宝、支付宝等核心业务,接入多项生活与政务服务,快速落地应用,让中国进入AI办事时代。
AI视频运镜玄学已破!告别无限抽卡,3D预演台直接封神
用AI做视频常遇运镜、人物走位等问题,因文生视频系统缺空间锚定能力。updream在8月17日上线「预演台」功能,通过传参考图自动生成3D白模场景,实测显示其显著减少「抽卡」次数。
全球首个多模态矢量动画生成框架,轻松拿捏跨平台轻量动画
复旦大学等团队推出OmniLottie框架,利用创新分词技术将视频、图文指令变成高质量矢量动画。团队还打造数据集MMLottie - 2M,构建测试基准MMLottie - Bench。实验显示,OmniLottie在多任务测试中优势明显。
一年拿下三轮融资!影目INMO正在鼻梁上“复刻”一个AI手机
影目INMO在一年拿下三轮融资,近5亿资金到位。其产品INMO GO3等表现出色,首发预订量可观。该公司专注轻量化一体式AI+AR眼镜,结合自研系统与智谱大模型,还拓展线下渠道,全球化布局也在推进。