「上科大」共找到 6393 篇相关文章
刚刚,Sam Altman发文,透露OpenAI正在干的大事业
OpenAI与甲骨文、软银合作新增5个AI数据中心选址,作为星际之门Stargate计划一部分,规划容量达近7吉瓦。CEO Sam Altman称构建强大算力是AI兑现承诺关键,还发文阐述对算力观点。
大模型的进化方向:Words to Worlds | 对话商汤林达华
量子位对话商汤林达华,探讨大模型发展。商汤的SenseNova - SI超越李飞飞团队模型,林达华认为单纯依赖参数规模的AI范式遇瓶颈,商汤推出NEO架构革新,还在落地应用优化,为年轻人指明新赛道。
The Batch:841 | 大语言模型正在纠正历史遗留的不公
美国北加州旧不动产契约含种族歧视条款,人工筛查耗时久。斯坦福和普林斯顿大学研究人员微调大语言模型实现自动识别,分析圣克拉拉县契约,发现诸多受影响土地,且揭示少数开发者推动住房隔离,模型已开源。
CVPR2026 | Streamo:让大模型变成实时流式交互助手
香港浸会大学联合腾讯优图实验室提出 Streamo,将‘何时回答’变为模型预测的 token,通过端到端训练框架把离线视频模型转化为实时流视频助手,还构建 Streamo - Instruct - 465K 数据集,实验效果良好。
Manus突发上新文生图!告别“抽卡”,Agent+深度思考联合创作
Manus深夜官宣支持生成图像,与一般AI绘图工具不同,它能理解画图目的,规划方案后再生成。它可完成如房间装修可视化、饮料瓶设计等任务。目前已开放注册,不过付费价格遭网友吐槽。
Github 4.1k star,SuperSonic AI×BI 大厂震撼开源
SuperSonic 是腾讯音乐开源的下一代 AI+BI 平台,融合 Chat BI 与 Headless BI 两种范式。它解决了传统 BI 工具复杂、数据口径不统一等痛点,有丰富功能和技术优势,适用于多业务场景,开源优势明显。
AI Infra入门干货总结:大模型是如何高效推理的
作者深入研读vLLM源码,以Llama 3为例,聚焦Decoder-Only架构LLM,介绍推理各环节及张量维度变化,讲解连续批处理和Paged Attention概念,还阐述推理流程、采样策略等,最后总结相关拓展内容。
忘记大模型,英伟达:小模型才是Agentic AI的未来!
截至2024年末,Agentic AI领域获超20亿美元初创公司融资。NVIDIA研究报告显示,多数Agentic AI场景中,小型语言模型已足够强、更适配、更便宜,LLM-to-SLM迁移是必然趋势。
从Foundation Model到Physical AI,三星「杀入」大模型核心战场
三星正快速进入大模型核心战场,构建Foundation Model体系,采购GPU用于AI基建。它提出Meki架构、M2RL训练范式和LiveClawBench评测体系,由AI Model TF团队推进,负责人是唐业辉。
Karpathy自称患上AI精神病!能力没有上限,一切都是Skill问题
Karpathy在播客中称自己患AI精神病,日常工作多依赖智能体。他认为智能体能力无上限,瓶颈在使用者技能。还探讨软件变革、自动化研究、模型分化等,对就业、开源等也给出看法。