「上科大」共找到 6393 篇相关文章
AGICamp 第 001 周 AI 应用榜发布:DeepPath、AI 好记、Remio 等上榜
2025年6月27日AGICamp在AICon大会发布第001周AI应用榜,上线14个应用。其暂不推日榜,周二发周榜,评论权重高于点赞。还介绍多个上榜应用,鼓励开发者参与,修复Bug并同步进展。
DeepMind大佬最新暴论:单体大模型穷途末路,未来买的不是模型,是"智能路由"
DeepMind研究员Andrew Trask认为,因Scaling Law对资源需求攀升,AI将成协议而非程序。组合不同厂商模型有优势,当主流榜单同等评分时变革加速,之后人们将买“智能本身”。
硬刚黄仁勋!AMD祭出「千倍算力大杀器」,「反黄联盟」崛起
CES现场,苏姿丰投下震撼弹:四年内AI算力将提升1000倍! 面对英伟达的封锁,AMD不再隐忍,直接祭出Helios「太阳神」机架与MI455X芯片,以单代性能暴涨10倍的「暴力美学」正面硬刚。
开盘大涨416%,市值近3000亿元,“国产GPU第一股”今日上市
12月5日,“国产GPU第一股”摩尔线程登陆A股,开盘大涨416%,市值近3000亿。它成立五年成国内代表企业,有全栈自研能力。不过,也面临国际巨头、国内竞品、供应链等挑战,且尚未盈利。
6.1B激活,三榜开源第一!蚂蚁·安诊儿医疗大模型发布
由浙江省卫生健康信息中心等联合研发的开源医疗语言模型AntAngelMed发布。它基于Ling - flash - 2.0,100B总参数仅激活6.1B达约40B密集模型性能,在多个权威医疗基准测评中居前列,采用三阶段训练流程,高效MoE架构。
142 TFLOPS 的差距:为什么在 Blackwell 上 FP4 MoE 算子工程至关重要
文章对三种主流MoE后端在Blackwell B200 GPU上做基准测试,发现SGLang与vLLM有142 TFLOPS差距,小batch时SGLang快1.84×。差异源于kernel融合、面向Blackwell的CUTLASS schedule及自适应grid sizing等优化。
《置身谷内》!Jeff Dean上顶会自曝离职现场:被1500人围堵
Jeff Dean在顶会KDD 2026晒出自己在谷歌离职前48小时的时间表。他忙碌告别,还正常上课、踢球,最后一刻“失业”,旋即成为Discovery Loop联创兼CEO。他为谷歌贡献巨大,告别会有1500人参加。
从自己出题到自己选题:耶鲁新方法让大模型 Self-Evolution 又进一步
本文解读了耶鲁、斯坦福等多机构联合提出的INFUSER大模型自进化新方法,针对现有方法仅以难度筛选训练数据的缺陷,提出用影响力分数筛选高价值训练题,实现双模型协同动态进化,实验验证效果显著。
Anthropic最强网络攻防大模型Mythos,美国国安局早就一直在用了
美国政府准备向多个联邦机构开放Anthropic新模型Mythos的‘修改版’,虽国防部将Anthropic拉黑,但国安局一直在用Mythos。白宫先明确模型接入的权限、用途等边界,再推进接入,各方对其态度有分歧。
人多不管用!智能体团队别盲目扩张,最新综述给出三大维度
随着大语言模型驱动的多智能体系统快速发展,核心问题是有些系统规模扩大后会失稳、低效。美国、英国和澳大利亚研究人员提出三维分类框架描述大规模智能体网络,指出真正决定系统表现的是三种机制组合。