「多语言能力」共找到 6969 篇相关文章
加速200倍,单显卡1.8秒生成5秒高清视频!清华与Vidu解开了视频扩散模型的速度枷锁
清华、生数科技与伯克利联手用TurboDiffusion解开视频扩散模型速度枷锁。它改造注意力机制、引入步数蒸馏和量化策略,在多模型测试中加速100 - 205倍,且画质几乎无损。
苹果放王炸!开放大模型访问权、全家桶集成ChatGPT,人人能开发AI应用
苹果在“WWDC 2025”大会宣布在多设备集成Apple Intelligence功能,含ChatGPT图像生成等。开放基础模型访问权,开发者可开发适配应用。新功能将逐步开启测试,今年秋季部分用户可用。
OceanBase全面拥抱AI!首发PowerRAG产品,CTO杨传辉详解AI战略
OceanBase在第三届开发者大会发布面向AI的应用产品PowerRAG,CTO杨传辉解释其AI战略,即构建Data×AI能力,推动一体化数据库向一体化数据底座演进,这对行业发展有推动作用。
RoboScience 机器科学发布轮式仿人形通用机器人 REX G1,让机器人真正成为新一代具身生产力伙伴
8月17日,RoboScience机器科学发布轮式仿人形通用操作机器人REX G1,定位“新一代具身智能生产力伙伴”。它搭载自研VLOA架构通用具身大模型Visics,适用于多场景,推动机器人承接完整任务。
Meta把内部设计系统开源了,支撑内部13000+应用,专为Agent调优
Meta开源的Astryx大更新,改造成Agent适配设计系统。它已在Meta内部演进8年,支撑13000+应用,提供150+可访问、可主题化的UI组件及开发工具,让人和AI用同一套语言。
tokens烧钱太快?试试这个四层模型组合
ClaudeCode等智能体兴起,开发者面临tokens不够用、主流模型降智问题。网络给出多模型策略缓解,网友将2026年主流模型分四档,还介绍了实际路由策略、部署建议,指出单模型依赖危险。
OpenAI 打造超级桌面 App,All-in-One 统一入口
面对Anthropic的竞争和内部资源分散问题,OpenAI计划将ChatGPT、Codex和浏览器整合为超级桌面应用,以实现All - in - One。转型有“Agentic”能力亮点,但面临组织、商业、安全挑战,还收购Astral等公司助力。
Pixeltable:一张表搞定AI流水线
Pixeltable是统一声明式框架,能处理多模态AI流水线。它用表格接口替代传统复杂架构,有数据统一管理等核心能力,适用于多模态RAG等场景,内置支持主流AI服务,值得多模态AI项目一试。
上手“设计界的Manus”,朱啸虎点赞,Lovart这波魔法破圈了丨TIP 002
国产出海产品Lovart被称为“设计界的Manus”,获朱啸虎点赞。它是设计领域首个Agent,能用自然语言驱动生成多模态视觉作品,可生成VI体系、短片等,适合文创领域,还能人工编辑,调用多模型。
奥特曼深夜长文警告:AI巨头必须集体「踩刹车」!
本文报道OpenAI创始人奥特曼发布深夜长文,警告AI狂飙已远超安全对齐与监控能力,存在两大致命生存威胁,呼吁全球AI巨头集体降速,推行前置安全管控机制。