「高继扬」共找到 1920 篇相关文章
终结数据荒!智源开源首个Deep Research数据合成框架InfoSeek
在大模型深度研究中,高质量数据是短板。近日,智源研究院发布首个面向深度研究的开源数据集InfoSeek,提出「扩散 - 回溯」数据合成方法,用3B模型在基准测试中接近商业模型表现,且数据集可扩容。
Meta联手UCSD发布DeepConf:计算成本暴降85%,99.9%准确率!
Meta AI联合UCSD推出DeepConf技术,解决了AI高难度推理准确率与计算成本的难题。它让AI学会“察言观色”,筛选靠谱推理路径,在AIME 2025竞赛中与GPT - OSS - 120B模型取得99.9%准确率,还节省大量计算资源。
GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~
智谱继GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试能助力科研各阶段,还介绍了其架构设计与训练策略。
相信大模型成本会下降,才是业内最大的幻觉
很多AI创业者认为模型降价能降成本、改善营收。但文章指出,成本下降仅针对老旧模型,最好模型成本大致相同,且模型token消耗激增。还探讨了AI创业商业模式,如按使用量计费、建立高切换成本、垂直整合等。
腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文
8月4日腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行。模型推理快、性价比高,在多领域表现出色,亮点是Agent和长文能力,已在腾讯多业务应用。
谷歌开源结构化信息提取神器!4K+ Star,精准定位+交互式可视化!
在医疗、法律等领域,手动从非结构化文本提取信息费力,传统NLP工具需复杂训练。谷歌开源的LangExtract是高精度信息抽取Python库,能自动提取结构化信息,有精确源定位等功能,还给出使用示例和典型场景。
为大模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考
本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让大模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决大模型深度思考的局限,且适配多种大模型,性价比高。
「流匹配」成ICML 2025超热门主题!网友:都说了学物理的不准转计算机
第42届国际机器学习大会(ICML)2025年7月将在加拿大举行,生成式AI前沿热点转向高质量、稳定、简洁、通用模型形态,流匹配技术踩中热点。它源于流体力学,能将噪声转化为数据,与扩散模型有紧密联系。
4000万样本炼出AI读心术,刷新七榜SOTA,最强「人类偏好感应器」开源
Skywork-Reward-V2全新发布,构建超高质量千万级人类偏好样本,刷新七大评测基准SOTA。8款模型覆盖6亿至80亿参数,小体积也能媲美大模型性能。团队引入多样大规模真实人类偏好数据,提升数据规模与质量。
YC AI 创业营第一天,Andrej Karpathy 的演讲刷屏了
Andrej Karpathy在YC AI创业营演讲引发关注,提出软件3.0时代来临,大量软件将被重写。还探讨了LLMs特性、半自主工具优势等。此外,文中整理了Sam Altman、李飞飞等嘉宾的精彩观点。