「单瓦特智能量」共找到 3849 篇相关文章
翁荔最新万字长文:Why We Think
北大校友、前OpenAI华人VP翁荔发布万字长文《Why We Think》,围绕“测试时计算”和“思维链”,探讨提升模型性能的方法,涉及心理学类比、基于Token的思考、分支与编辑等多方面内容。
超越OpenAI、拿下全球双料第一,“AI吴彦祖”背后大模型SOTA了!
国产大模型MiniMax发布Speech - 02,拿下两项全球权威语音基准测评第一,是榜单前十唯一国产玩家。它超拟人、个性化、多样,技术创新,且在多行业落地,全模态布局领先。
Borg调度进化了!谷歌超强AI Agent 登场:能设计算法、提效系统,陶哲轩亲自助攻,网友封神理科扛把子!
谷歌 DeepMind 推出由 Gemini 驱动的 AI 智能体 AlphaEvolve,能设计算法、提效系统,破多项数学记录。它已用于谷歌多领域,还将探索材料、药物研发等领域,也计划推早期访问计划。
文生图进入R1时代:港中文MMLab发布T2I-R1,让AI绘画“先推理再下笔”
港中文MMLab团队发布首个基于强化学习的推理增强文生图模型T2I - R1。它提出双层级CoT推理框架和BiCoT - GRPO强化学习方法,解决生成评估难题,为多模态生成提供新范式。
“光靠人盯不住了”!拆解上万张晶圆,这家公司靠 AI 将芯片良率提升数个百分点
喆塔科技创始人赵文政看好半导体软件领域引入AI技术。喆塔将DeepSeek接入自研模型,应用机器学习算法提升半导体企业良率,构建智能生态系统,产品获客户认可,未来将加大研发投入。
4月30日凌晨,Meta举行首届AI开发者大会LlamaCon,推出Meta AI聊天机器人应用程序与ChatGPT竞争,发布Llama API。Meta试图强化开源模型生态系统以限制OpenAI发展,扎克伯格与微软CEO还探讨了开源闭源模型生态等内容。
0.25秒识破未见攻击,这套检测方法没看过任何越狱样本 | EMNLP'26
大视觉语言模型带来隐蔽攻击面,现有检测器难平衡。中国人民大学与阿里巴巴集团联合提出Learning to Detect(LoD),不依赖攻击样本和手工规则,从模型内部激活学安全模式,实验效果好且代码开源。
开源模型两个月内杀死比赛
过去60天,Vercel AI Gateway调用数据显示,开源模型Token调用份额从28%涨至62%,反超闭源模型。英伟达60亿美元入局扶持,闭源虽推新降价仍失领先,开源走向大规模应用。
刚刚英伟达核弹级战略曝光!老黄宣布联手奥特曼圈地圈电,狂卷16GW算力霸权
英伟达宣布亲自下场锁定土地、电力和厂房等资源建超级AI工厂。与SB Energy联手在美拿下LPS容量,租客是OpenAI。文章分析合作原因、价值,解答外界疑问,称英伟达成全栈AI基建平台。
终于!世界模型进入“有声时代”:24FPS画面+48kHz立体声实时生成
过去两年视频生成模型不断提升画面参数,但传统模型生成的视频固定,用户无法干预。而世界模型可跟随操作实时渲染、动态生成世界。目前Noiz AI联合多机构发布实时可交互音视频世界模型HelixWorld 1.0,后续还将开源。