「在离线混部」共找到 8185 篇相关文章
王小川:30亿现金在手,明年IPO,toC产品马上就发
百川智能CEO王小川明确发展主线,百川开源新一代医疗大模型Baichuan-M3,在医疗评测中表现优异。公司约30亿资金,预计2027年IPO,今年将发两款to C医疗产品,重点在院外诊疗。
智算,云厂商的下一个战场
随着大模型技术走向产业,企业需算存网数一体的高性能智算底座。领先云厂商积极升级能力,如腾讯云推出“云智算”,在计算、存储等方面布局迭代,还在多领域与企业合作,推动智算发展。
横扫硅谷的千问,杀回国内了
阿里Qwen模型获硅谷认可,Airbnb等公司盛赞。Qwen3 Max在投资大赛夺冠,多模型在各测试表现优异。11月14日阿里推千问APP,金沙江朱啸虎称其为中国ChatGPT,从多维度对比,千问表现出色。
刚被马斯克收购,Cursor掏出新模型:10万卡加持,和Opus、GPT一样大
本周二,刚被SpaceX收购的Cursor在首届旗舰大会宣布新的1.5万亿+参数模型,在超10万块GPU预训练。Cursor CEO称其规模与Opus、GPT相当,还谈了对其他AI实验室看法,新模型将几周内发布。
狂揽53.7K Star!这款强大优雅的终端美化神器,进度条、表格、Markdown应有尽有,绝了!
在Python开发中,默认`print`函数输出单调,影响开发体验。开源工具`Rich`可解决此痛点,它由Textualize团队开发,有富文本和精美格式输出功能,自带表格、进度条等功能,在GitHub获53.7K Star。
社区供稿丨以小博大!Nanbeige4-3B重磅开源:硬刚Qwen3,挑战小模型能力新高度
近年来大语言模型发展陷入‘参数军备竞赛’,成本高昂。Boss直聘南北阁实验室发布Nanbeige4 - 3B,仅30亿参数,在预训练和后训练阶段采用多种创新技术,在多方面媲美甚至超越大模型。
Nature Machine Intelligence颠覆有机化学研究范式,上海交大发表化学合成大语言模型
上交大AI4S团队依托平台,联合多团队在AI for Chemistry领域获突破。相关研究发表于《Nature Machine Intelligence》,介绍白玉兰化学合成大模型Chemma,它加速有机合成全流程,在多任务表现出色,还能解决数据稀疏等问题。
AI“压力面”,DeepSeek性能暴跌近30% | 清华&上海AI Lab
上海人工智能实验室等团队设计REST框架,在一个prompt里抛多个问题模拟多任务推理场景。测试发现即便顶级模型如DeepSeek - R1在“高压”下准确率也骤降,该框架能揭示模型差异,为评测提供新范式。
“甲方快乐模型”诞生,拿下平面设计新SOTA!多条件一键生成,还能独立调整元素 | 复旦&字节
复旦大学和字节跳动团队联合提出CreatiDesign新模型,可实现高精度、多模态、可编辑的AI图形设计生成。它解决了以往方法在处理图形设计时的难题,在多维度评估基准上表现出色,还支持多轮编辑。
快手高欢深度解读:多模态理解如何成为AIGC视频生成的“幕后功臣”?
2024 年 AIGC 爆发,多模态理解技术支撑 AIGC 原生应用。快手高欢在 AICon 大会分享多模态理解在 AIGC 场景应用,介绍主流 AIGC 产品形态,探讨其背后多模态理解方法、提升能力途径及赋能 AIGC 的方向。