「复杂运动生成」共找到 3040 篇相关文章
航空发动机用上大模型:解决复杂时序问题,性能超越ChatGPT-4o实现SOTA|上交创智复旦
上海交通大学李元祥教授等团队提出ITFormer架构,构建EngineMT-QA数据集。ITFormer能融合时序数据与大语言模型,适配多种编码器和模型,在EngineMT-QA预训练后达SOTA水平,实现高效数据分析。
PDF难点解析:处理复杂表格、水印、印章、复选框、信息抽取等7项任务,6大能力
文章介绍Nanonets - OCR - s可处理关键信息提取、视觉问答等7项任务,具备LaTeX方程识别、图像描述等6项能力,还给出体验链接。但测试发现英文体验优于中文,模型有重复输出、幻觉严重问题。
揭秘夸克首个高考志愿大模型!蒸馏数百名人类专家经验、Agent 可完整生成志愿报告
6月12日,夸克发布国内首个高考志愿大模型,上线‘高考深度搜索’等三大核心功能。其‘志愿报告’以Agent运行,能输出完整报告;模型经多阶段训练,搭载最大高考知识库,为考生提供精准志愿填报服务。
上海AI实验室发布 Intern Lumina U2:全离散扩散建模,让模型既能“看懂”也能“生成”
上海人工智能实验室发布新一代多模态统一模型 Intern Lumina U2,基于全离散扩散建模路线,支持多任务,适配两大硬件生态,在昇腾千卡级集群训练效率提升 1.85 倍,性能优异且将开放资源。
生数科技认领神秘登顶模型:AI视频公司拿出工业级Demo,跨本体跑通复杂长程任务
生数科技认领神秘登顶模型MotuBrain,该模型4月中旬悄登两国际benchmark。它将预测与行动统一,具一脑多型等能力,技术上走边看边动路线,有响应快等优势。生数科技双轨布局,Vidu与MotuBrain同根。
一个现代化AI 内容聚合平台,集成了 AI 报告生成、飞书机器人推送、多源内容聚合等高级功能
RSS - AIGC 是现代化 RSS 订阅与 AI 内容聚合平台,有智能内容聚合、AI 内容加工等核心能力。具备 RSS 订阅管理、内容聚合等功能,还介绍了环境要求、配置说明及部署指南。
源神阿里!图像生成Ovis-Image再开源,7B小参数媲美GPT-4o和20B开源模型
阿里Ovis团队发布Ovis - Image,7B参数文本到图像模型,在文本渲染任务媲美GPT - 4o和20B + 开源模型。它架构优化、数据工程精细、训练范式独特,实测数据表现佳,显存占用低、推理快。
重磅!谷歌开放世界模型Genie 3试用:AI实时生成可玩世界,人人都能创造“我的世界”
谷歌开放世界模型Genie 3实验性研究原型Project Genie试用,美国18岁以上Google AI Ultra订阅用户可体验,能创建、探索和重混互动世界,不过Genie 3是早期研究模型,有待改进之处。
AI编程冲刺“DeepSeek时刻”:00后团队用国产模型一键直出复杂应用,效果超越Claude Code
云端Agent有新进展,重新定义AI编程范式。Vinsoo上新Beta 3.0版本,仅用国产大模型就超越一众流行AI编程产品。它解决了4个核心技术问题,还带来三重云端AI Agent新体验,其研发团队由00后主导。
兄弟们,人都麻啦,网站克隆+AI生成前端,又一个卷王项目,这叫我还怎么卷啊!!!
Open Lovable由Firecrawl团队开源,输入网站URL,AI就能将其转换为可运行的React/Next.js应用。项目亮点是开源、支持多AI提供商等,可解决原型开发、旧站迁移等痛点。