高继扬」共找到 1920 篇相关文章

开源动态8

终结数据荒!智源开源首个Deep Research数据合成框架InfoSeek

在大模型深度研究中,质量数据是短板。近日,智源研究院发布首个面向深度研究的开源数据集InfoSeek,提出「扩散 - 回溯」数据合成方法,用3B模型在基准测试中接近商业模型表现,且数据集可扩容。

新智元
开源动态8

Meta联手UCSD发布DeepConf:计算成本暴降85%,99.9%准确率!

Meta AI联合UCSD推出DeepConf技术,解决了AI难度推理准确率与计算成本的难题。它让AI学会“察言观色”,筛选靠谱推理路径,在AIME 2025竞赛中与GPT - OSS - 120B模型取得99.9%准确率,还节省大量计算资源。

AIGC开放社区
开源动态8

GLM4.5之后,智谱又开源GLM-4.5V,实测下来视觉推理能力贼强~

智谱GLM-4.1V-9B-Thinking、GLM-4.5后,又开源最强多模态推理模型GLM-4.5V,在多模态理解榜单达开源SOTA。它视觉推理强,经测试能助力科研各阶段,还介绍了其架构设计与训练策略。

CourseAI
推荐文章7

相信大模型成本会下降,才是业内最大的幻觉

很多AI创业者认为模型降价能降成本、改善营收。但文章指出,成本下降仅针对老旧模型,最好模型成本大致相同,且模型token消耗激增。还探讨了AI创业商业模式,如按使用量计费、建立切换成本、垂直整合等。

Founder Park
开源动态8

腾讯混元开源 4 个小尺寸模型,主打 Agent 和长文

8月4日腾讯混元开源四款小尺寸模型,参数为0.5B、1.8B、4B、7B,消费级显卡可运行。模型推理快、性价比,在多领域表现出色,亮点是Agent和长文能力,已在腾讯多业务应用。

AI前线
开源动态8

谷歌开源结构化信息提取神器!4K+ Star,精准定位+交互式可视化!

在医疗、法律等领域,手动从非结构化文本提取信息费力,传统NLP工具需复杂训练。谷歌开源的LangExtract是精度信息抽取Python库,能自动提取结构化信息,有精确源定位等功能,还给出使用示例和典型场景。

开源星探
算法论文8

为大模型思考装上“猎鹰重装引擎” :腾讯混元 SEAT 重塑深度思考

本文深度解析腾讯混元最新发布的 SEAT 自适应并行扩展推理框架。它让大模型 CoT 升级,应对复杂推理任务。该框架通过多轮并行推理和语义熵导航,解决大模型深度思考的局限,且适配多种大模型,性价比

AI科技大本营
新闻资讯7

「流匹配」成ICML 2025超热门主题!网友:都说了学物理的不准转计算机

第42届国际机器学习大会(ICML)2025年7月将在加拿大举行,生成式AI前沿热点转向质量、稳定、简洁、通用模型形态,流匹配技术踩中热点。它源于流体力学,能将噪声转化为数据,与扩散模型有紧密联系。

机器之心
开源动态8

4000万样本炼出AI读心术,刷新七榜SOTA,最强「人类偏好感应器」开源

Skywork-Reward-V2全新发布,构建超质量千万级人类偏好样本,刷新七大评测基准SOTA。8款模型覆盖6亿至80亿参数,小体积也能媲美大模型性能。团队引入多样大规模真实人类偏好数据,提升数据规模与质量。

新智元
新闻资讯8

YC AI 创业营第一天,Andrej Karpathy 的演讲刷屏了

Andrej Karpathy在YC AI创业营演讲引发关注,提出软件3.0时代来临,大量软件将被重写。还探讨了LLMs特性、半自主工具优势等。此外,文中整理了Sam Altman、李飞飞等嘉宾的精彩观点。

Founder Park