「小语言模型」共找到 8461 篇相关文章
空间智能新高度:港科大谭平团队SAIL-Recon突破万帧级图像大规模3D场景重建Transformer
香港科技大学谭平教授团队与地平线团队发布3D场景表征与大规模重建新方法SAIL - Recon,突破现有模型处理能力瓶颈,可实现万帧级场景表征抽取与定位重建,在多数据集上表现优于现有方法。
仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力?
这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。
LLM 商业化猜想:OpenAI 会走向 Google 的商业化之路吗?|AGIX PM Notes
文章探讨了大模型商业化难题,对比 OpenAI 潜在变现方案与 Google 商业模式,分析 OpenAI 开启类似 Google 商业化引擎的可能性,还给出 AI 搜索引擎可能的变现思路,并总结了本周市场情况及 AI 公司动态。
藏师傅教你用 Nano Banana 编辑图片做手办
前几天发 Nano Banana 测评后,很多人不知怎么用。刚好做手办图玩法火了,作者教大家在 LM Arena 用 Nano Banana 编辑图片、做手办图,还介绍把图片变视频及剪辑的方法。
实测GPT-5:写作坠入谷底,编程一骑绝尘。
GPT-5发布,它是统一系统,含多种模型。性能上减少事实幻觉、应对谄媚有进展,跑分强且节能,但无新功能特性。写作不如GPT 4.5,编程表现出色,发布后OpenAI与Google预测交叉跳水。
奥特曼出新招防挖角!员工期权变钞票,按5000亿美元估值兑现
被挖怕了的奥特曼开启新一期员工期权兑现计划,按5000亿美元估值兑现。这一计划若推进,既能留人,也能推高OpenAI估值。目前OpenAI发展态势好,但也面临与微软谈判等挑战。
1.6万人「卷」出科学未来!盛夏AI4S上海巅峰赛,谁人终得桂冠?
7月25 - 26日,第三届世界科学智能大赛总决赛及颁奖典礼在上海举行。大赛面向全球选拔,设五大赛道,吸引近1.6万人参赛。大赛秉持开源开放,成果将在星河启智平台共享,还开辟中学组,展现青少年潜力。
DeepSeek一体机最新观察:满血版卖不动了,市场抢食零散的中低端机型生意
本文聚焦DeepSeek一体机市场,上半年国央企等大客户采购高端机型需求旺,头部硬件厂商营收可观,中小厂商冷清。下半年高端市场饱和,中低端机型“游击战”开打,部分厂商用国产芯片降成本,部分有政府关系的新厂商入局。已售一体机落地难,需杀手级应用和用户数据。
爆肝一周看6小时长视频,解读AI时代程序员价值几何
作者花一周看完Lex Fridman对丹麦传奇程序员DHH的6小时访谈。DHH分享编程经历,谈对流行技术看法,认为AI不能取代人类创造力,还谈及创业、开源等观点,展现深刻认知与独特态度。
AlphaEvolve:陶哲轩背书的知识发现 Agent,AI 正进入自我进化范式
Google今年5月发布的AI系统AlphaEvolve,结合Gemini模型与evaluator,能发现新算法。它源于FunSearch,可多领域应用,运行机制类似自然进化,其关键组件evaluator对其发展很重要,也标志AI进入自我改进范式。