「多尺度生成」共找到 5754 篇相关文章
极客说|Unsloth 的全微调之路:从 Adapter 到 Full Fine-tuning
大语言模型参数多,微调难。Unsloth 原靠支持 Adapter 微调出名,现支持全参数微调,单卡就能搞定大规模模型训练。文章介绍其进化历程、关键技术、工程部署、使用优势及最佳实践。
谷歌开源基于物理模拟的气象模型,能预测暴雨、台风、大干旱
传统通用循环模型处理小尺度有局限,谷歌开源基于物理模拟的神经通用环流气象模型NeuralGCM,在预测突发恶劣天气出色,还介绍其动态核心、物理模拟模块等,经测试有一定优势。
1/8成本比肩Claude 3.7,Mistral Medium 3来了
“欧洲OpenAI”Mistral AI发布多模态新模型Mistral Medium 3,主打编程和多模态理解,成本仅Claude 3.7的1/8,性能达其90%,API已上线,还推出企业聊天机器人服务,引发网友不同看法。
AI可观测行平台Lightrun,获7000万美元
AI可观测性平台Lightrun获7000万美元B轮融资,由Accel和Insight Partners领投。它改变传统监测工具局限,实现实时调试修复。连续三季成G2领域领导者,获众多企业信赖,发展迅猛。
Opus5.5 正在吃掉视频!分镜、动画、音效、配乐,它全做了
本文作者实测Claude Opus5.5的视频制作能力,除人工配音外,分镜、动画、音效、配乐全靠代码完成,对比GPT-6 Astra展示各环节提升,验证大模型全流程做视频的可能性。
“当年在OpenAI像在疯人院!”Jev作者完整访谈:全人类陪AI聊天的价值,不如程序员一个for循环
本文整理了前OpenAI核心研究员、Jev模型创始人Diogo Almeida的完整访谈,Diogo批判当前行业all in聊天大模型的路径偏差,推出专为程序决策设计、不做聊天交互的Jev模型,提出全新RLCD技术范式,倡导AI作为软件底层基础设施赋能自动化生产力。
实时编辑、实时互动视频双旗舰,Vidu S2发布即体验
本文介绍生数科技推出的Vidu S2,专为实时交互编辑设计的AI视频模型,覆盖三类核心能力,公开技术路线,发布当天开放体验与API,迭代仅用69天。
27岁研究员连辞OpenAI、Anthropic!两家都在拿我们的命下注
本文报道GPT-4o核心贡献者Jacob Coxon接连从OpenAI、Anthropic辞职并退出AI行业,批判头部AI机构陷入竞速赛,罔顾超级智能失控风险,直指行业需共同踩刹车。
T-RO综述重构Foundation Model时代机器人操作知识版图
近日,论文《Embodied Robot Manipulation in the Era of Foundation Models: Planning and Learning Perspectives》被IEEE Transactions on Robotics接收,它以High - Level Planning和Low - Level Action Modeling为主线,梳理Foundation Model时代机器人操作发展,分析了现存问题及关键缺口。
马斯克的 Grok Bot 正在吞掉电脑,买 Mac mini 的事可以先缓缓
重度使用 Codex 大半年,电脑不堪重负,Agent 任务增多让本地电脑成瓶颈。Grok Bot 将 Agent 工作搬到云端,配云电脑,解决本地硬件难题,还为 Bot 分配独立屏幕,实现人机电脑分工。