多模态文本智能」共找到 4457 篇相关文章

推荐文章7

Ropedia刘子纬:具身智能的Scaling Law,不是算力,是人类的经验

Ropedia刘子纬指出,当前物理AI面临差距,下一阶段需Scaling人类物理世界的经验。Ropedia构建真实世界经验引擎,形成经验飞轮,目标是打造能看见、记住、想象并行动的模型。

Founder Park
产品应用8

Deepseek V4 Pro发布,除了多模态,满足我对模型的所有想象

DeepSeek官方文档更新模型日期,意味着DeepSeek V4 Pro正式版来临,已在官方API提供。它采用MoE设计,接口能力强,Agent能力得到大幅强化,评测成绩亮眼,价格实惠且有API兼容性,不过有并发限制,近期还将上调价格。

鲸选AI
算法论文8

ICML 2026 | 西湖大学提出 PiEvo:基于原理进化的科学发现智能体框架

西湖大学研究团队提出PiEvo框架,将科学发现重点从“搜索假设”转变为“进化科学原理”,通过不确定性最小化实现原理空间自主扩展。该框架构建双循环优化机制,实验结果显示其核心指标超越SOTA,收敛速度大幅提升。

AINLPer
产品应用7

这家公司刚成立7个月,正在打磨通用具身智能的终极形态

超维动力(Kinetix AI)于2025年7月注册,9月研发,不足一年便举办独特发布会,让KAI人形机器人“自己发布自己”。其认为高拟人是训练强世界模型前提,构建了含本体、世界模型等的技术体系,但面临工程与成本挑战。

机器之心
产品应用7

当AI迈入Harness时代:以MiniMax为样本看智能体云端新基建

2026年初,随OpenClaw爆火,AI步入Harness时代,MiniMax成变革焦点,推出MaxClaw和MaxHermes。但本地单机框架用于企业级生产有鸿沟,MiniMax借助阿里云云原生方案重塑Agent运行底座。

机器之心
产品应用8

全球首个多模态矢量动画生成框架,轻松拿捏跨平台轻量动画

复旦大学等团队推出OmniLottie框架,利用创新分词技术将视频、图文指令变成高质量矢量动画。团队还打造数据集MMLottie - 2M,构建测试基准MMLottie - Bench。实验显示,OmniLottie在多任务测试中优势明显。

AIGC开放社区
新闻资讯8

刚刚,Claude Mythos敲响末日警钟!超级智能已在悬崖,Hassabis深感恐惧

前沿AI已能自主攻击、逃逸,Anthropic因太危险暂不发布Claude Mythos Preview模型。谷歌DeepMind掌门人Hassabis、OpenAI CEO奥特曼均发出警告,虽恐惧AI风险却仍推进开发。

新智元
开源动态8

OpenClaw Master Skills:339+ 精选 AI 技能库,让你的智能助手更强大

推荐宝藏级开源项目 OpenClaw Master Skills,它是 MyClaw.ai 团队维护的技能库,汇集 339+ 个 OpenClaw 技能,涵盖多领域,功能亮点多,适用场景广,还介绍了使用方法、精选技能及选择理由。

小华同学ai
新闻资讯7

15岁少年养AI龙虾,月入3万美元!智能体黄金时代真来了

OpenClaw发布2026.3.13更新,实现无需插件关联用户实时会话的技术突破。15岁少年用其赚超3万美元合同收入,还有多人借AI创业。AI正从工具向员工、创业者转变,未来或现AI经理人。

新智元
开源动态8

SOP:具身智能在线进化新范式,为大规模真实世界部署而生

智元机器人具身研究中心提出SOP在线后训练系统,将VLA后训练重构为“在线、集群、并行”,可即插即用后训练算法。它有高效探索、缓解偏移等优势,实验显示能提升性能、效率,突破VLA瓶颈。

PaperAgent