「AI编程模型」共找到 13737 篇相关文章
治好多模态近视和走神!上海大学去偏干预显著提升模型性能
多模态大模型存在“近视”和“走神”问题,总是过度关注图像底部而忽略核心内容。上海大学与南开大学研究团队用两条数学公式去偏干预,无需增加计算成本,却能显著提升主流模型视觉理解能力。
dLLM的「Free Lunch」!浙大&蚂蚁利用中间结果显著提升扩散语言模型
近年来,扩散大语言模型(dLLM)成为文本生成新势力,生成效率高。但现有解码策略忽视中间迭代信息,研究团队观察到「先对后错」现象,提出 TCV 和 TCR 方法,显著提升模型在推理任务表现。
黄仁勋CMU演讲:取代你的是会AI的人,所有人同一起跑线,奔跑吧
卡内基梅隆大学毕业典礼上,黄仁勋发表演讲。他指出AI不太可能取代人,但善用AI的人可能取代他人。他还提及计算范式转变,新工业带来新潜能,呼吁毕业生全力奔跑塑造未来。
100根内存条换一套房!AI疯狂吞噬全球内存,普通人电脑快买不起了
2025年下半年起,AI撞上「内存墙」,2026年或成「内存受限」之年。巨头扫货致内存产能被吸,消费级市场供给枯竭,价格飞涨。内存成AI瓶颈,科技界正从硬件和架构上革命破局。
手握1000项专利的“药物狂人”,为何在AI制药时代选择逆行?
手握约1000项专利的再生元联合创始人乔治·扬科普洛斯,在AI制药成热点时选择逆行,坚持内部研发、人类遗传学和基础生物学。他批评跟风,强调深入理解疾病机制,认为AI可增效但不能决定方向。
英伟达开源9B参数小模型,比Qwen3快6倍
英伟达推出新型小型语言模型Nemotron Nano v2,在复杂推理基准测试上准确率与Qwen3 - 8B相当或更高,速度快6倍。它兼顾推理与非推理任务,支持“思考”预算控制,还开源了创建模型的绝大部分数据。
一个中大型组织到底需要怎样的AI办公,这场闭门会说清楚了
今年初麻省理工报告指出企业AI投入大但多数试点难量化回报。6月9日金山办公举办闭门会,探讨企业级AI问题,指出其要过数据、知识、安全三关,还给出选场景、重数据等判断。
OpenAI偷袭,谷歌掀桌!2026开年第一场AI大战太精彩
OpenAI悄悄上线ChatGPT Translate挑战谷歌翻译,该工具支持超50种语言,有翻译后「二次加工」能力,但功能尚不完善。谷歌则高调开源TranslateGemma模型,支持55种语言,效率惊人,12B参数超越27B基线。
DeepSeek-R2可能本月发布,使用华为AI芯片
Huaweicentral消息,搭载华为昇腾AI芯片的DeepSeek - R2可能8月15 - 30日发布,或媲美GPT - 5。它运行在昇腾910B芯片集群,参数规模达1.2万亿,将以低价提供API,冲击开源大模型市场。
硅谷天价挖人挖疯了!AI人才大缺血咋办?我方更优答案新鲜出炉
AI发展中人才成关键变量,全球AI圈抢人激烈,Meta高价挖角,国内企业也各有培养计划。AFAC2025金融智能创新大赛由多方联合举办,成为筛选复合型人才的有效方式,正推动行业生态繁荣。