「领域大模型」共找到 9865 篇相关文章
黑马图像模型被Nano Banana技术负责人点赞!15人华人小队,DDIM之父&CVPR最佳论文作者带队
Luma AI推出全新图像模型Uni - 1,对标谷歌Nano Banana Pro和GPT Image 1.5。它是统一图像理解与生成模型,多项评测表现出色。背后是不到15人的华人团队,由DDIM之父和CVPR最佳论文作者带队。
刷新世界记录!40B模型+20万亿token,散户组团挑战算力霸权
Nous Research推出Psyche网络,用区块链汇聚全球计算资源,启动40B参数大语言模型Consilience预训练,达20万亿token创纪录。还解决带宽瓶颈等问题,让AI训练去中心化,推动创新与民主化。
Sand.ai开源发布MagiCompiler:突破局部编译界限,定义训推性能上限
大模型开发者面临速度与显存的两难选择,原生torch.compile有局限。Sand.ai开源MagiCompiler,突破传统编译界限,提出Compiler as Manager理念,解决算力与显存墙难题,性能实测亮眼,且接入简单。
重大技术突破!微软发布BioEmu模型,蛋白质模拟从数年压缩至几小时
今天凌晨,微软CEO分享蛋白质模拟模型BioEmu,可将蛋白质动态模拟从数年缩至几小时,已在《自然》发表。它能解决传统方法难题,核心设计独特,训练整合多数据源、采用多阶段策略。
谷歌、OpenAI同日发布模型,一个最快最具性价比,一个主打「人情味」
深夜谷歌和OpenAI相继推出新版本大模型Gemini 3.1 Flash - Lite、GPT‑5.3 Instant。前者专为大规模智能设计,性价比高、速度快;后者让日常对话更稳定实用,减少幻觉,提升了多方面表现。
神秘爆款模型被小米认领!雷军直言超过马斯克 xAI Grok,罗福莉透露MiMo-V2-Pro将开源
小米发布 MiMo-V2 家族三款新模型,确认 Hunter Alpha 是 MiMo-V2-Pro 早期版本。雷军称其超马斯克 Grok,罗福莉透露模型稳定后将开源。MiMo-V2-Pro 适用于 Agent 场景,Omni 关注全模态交互,TTS 面向语音生成。
苹果炮轰AI推理遭打脸,GitHub大佬神怒怼!复杂任务≠推理能力
苹果发表论文指出推理大模型存在重大缺陷,相关解读在社交平台广泛传播。但GitHub高级工程师Sean Goedecke对论文持保留态度,认为谜题不是评估推理能力的好试验场,模型放弃不代表无推理能力。
链式思维是幻象吗?从数据分布视角重新审视大模型推理,马斯克回复,Grok破防
亚利桑那州立大学研究发现,思维链(CoT)推理可能只是对训练数据分布内模式的复现,输入与训练数据分布有差异时,推理链条会失效。研究探究了CoT泛化性等问题,对实际应用提出警示。
小扎“亿元俱乐部”开招白菜岗,年薪20-30万美元,网友:是时候招牛马干苦力了
Meta超级智能实验室开招产品运营经理,年薪总包20 - 30万美元,与公司正常薪资持平。岗位聚焦AI模型,要求本科以上、6 + 年经验,旨在确保大模型产品顺利上线。
Anthropic发最高警告:0day大爆发即将来临!全球巨头瞬间蒸发数十亿
Anthropic发布新模型预览版Claude Mythos Preview,它在测试中表现惊人,致网络安全巨头Cloudflare股价暴跌。这动摇了SaaS帝国根基,Anthropic启动计划发布生存指南,却遭顶级黑客质疑。