「多模态处理能力」共找到 4467 篇相关文章
5Y News | 华深智药完成7.87亿美元融资,刷新2026生物技术公司融资记录
华深智药近日完成7.87亿美元融资,由Dimension Capital等主导。其利用AI技术重新设计新药研发各环节,AI原生平台已有40多个研发项目。融资将助力推进药物研发,此前与赛诺菲合作价值超44亿美元。
马斯克刚刚官宣了“芯片美国梦”
美国当地时间3月21日,马斯克联合SpaceX、Tesla、xAI发布TERAFAB项目,启动超大规模芯片制造设施,目标年产1太瓦计算能力,80%产能服务太空任务,虽面临诸多挑战,但意义深远。
告别AI「鬼画符」!一行指令「复活」王羲之、苏轼,带连笔、懂排版,项目已开源丨ICLR'26
UniCalli由香港科技大学(广州)等团队推出,是全新统一扩散框架,能精准生成书法排版和连笔,将书法生成和古籍识别统一,工作被ICLR2026接收,代码、数据集开源,还有在线Demo。
告别噪声初始化:NTU MARS Lab提出A2A新范式,实现机器人高性能单步动作生成
新加坡南洋理工大学 MARS Lab 提出 Action-to-Action (A2A) Flow Matching 新范式,以历史机器人轨迹为生成起点,打破生成速度与精度瓶颈,在训练效率、推理速度及泛化表现上佳,还可扩展至视频生成领域。
智谱 AutoClaw 深度测评:一键把电脑变成 AI Agent,是神器还是半成品?
本文深度测评智谱最新推出的桌面应用AutoClaw。它宣传能让电脑成AI Agent,引发两极评价。文章从安装、界面、功能、成本等方面测评,指出其优缺点,认为虽不完美但方向值得肯定。
计算所 x 上交大论文:只用双人数据,也能生成多人动画丨CVPR 2026
中国科学院计算技术研究所与上海交通大学团队提出多人物动画生成框架MultiAnimate,引入身份标识与空间关系建模方法,用双人数据训练,能扩展到多人动画生成,优于现有方法。
最权威的Skills编写指南来了!33页,Anthropic亲自发布
Anthropic发布33页《Skills编写完整指南》。Skills能为智能体注入行业经验与工作流,实现复杂任务自动化。指南梳理了编写逻辑,涵盖定制、构思、测试、发布等全生命周期内容。
还不会用 OpenClaw?已经有人靠龙虾月入 7 万美元了
文章介绍 OpenClaw 的应用场景,如国外小哥靠它和 11 个应用月赚 7.3 万美元。还阐述其在自动化内容、找网红合作、客户支持、KPI 报告及 X 与 YouTube 内容自动化等方面的作用,强调能节省时间和成本。
中国电影资料馆成功申报《图像修复的方法、装置、电子设备、存储介质及程序产品》国家专利
日前,中国电影资料馆研发的《图像修复的方法、装置、电子设备、存储介质及程序产品》成功申报国家专利。该专利用AI模拟修复师思路,解决传统AI修复缺陷,为老电影修复提供智能精细方案,是该馆首个专利。
Agent Team 实践与架构设计:在约束下构建可演进的一个人开发团队
作者结合构建的Routa,探讨在Token、流程、工具选择等约束下构建可演进的多Agent系统。介绍了Routa架构、原则,如跨Agent通信、状态外置等,还阐述了各设计要点及示例,强调系统可演进性。