新闻类播客」共找到 3791 篇相关文章

算法论文8

阿里通义发布并行计算策略:1.6B等效4.4B,内存消耗骤降95%

阿里通义团队提出PARSCALE并行计算策略,受CFG双路径推理机制启发,将并行思想扩展到训练和推理全流程。能让1.6B模型性能接近4.4B模型,内存占用大降,还可用于现有模型,无需从头训练。

量子位
产品应用8

d-Matrix用3D堆叠技术终结"内存墙",AI推理迎来光速时代

2025年9月Hot Chips上,d - Matrix展示3D堆叠数字内存计算技术,直击AI“内存墙”难题。其产品Corsair带宽强大,Pavehawk架构更有性能跃升,为AI推理开辟赛道,虽面临挑战但前景可期。

AIGC开放社区
开源动态8

Qwen3深夜开源系列:文本表征模型,3种尺寸可选,超越商业API拿下SOTA

Qwen3深夜上Embedding系列,专为文本表征等任务设计,在Qwen3基础模型上训练,有0.6B/4B/8B三种尺寸,8B版本在MTEB榜单排第一,性能超商业API,已在多平台开源。

量子位
开源动态8

准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位神器LocAgent来了

OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。

机器之心
算法论文8

斯坦福&英伟达提出范式:推翻Scale Law,在“推理”阶段自我进化,超越人专家

斯坦福和英伟达提出 TTT - Discover 范式,允许模型在测试时继续训练,针对难题‘进化’。它设计了自适应熵目标函数和 PUCT 状态复用组件,实验在多领域碾压人专家与同行,但在部分领域落地有局限且计算成本高。

深度学习自然语言处理
产品应用8

这个真人版《火影忍者》竟然是AI做的,来自中国AI视频王者Vidu Q3

开年国产AI竞争激烈,AI视频生成圈出全球首个支持16秒音视频直出的Vidu Q3。它能全自动生成,语言支持多语种,经权威认证排名中国第一、全球第二,可实现图生和文生音视频,提升了AI视频生成能力。

量子位
开源动态8

多人会话视频生成突破:香港科技大学,浙江大学用单人数据实现多人交互视频生成

香港科技大学、浙江大学等开源 AnyTalker,提出音频驱动多人交互生成范式。它用创机制和两阶段训练策略,以少量数据实现多人视频生成,还构建评估指标,性能超现有方法。

AIGC开放社区
新闻资讯7

对骂之外,奥特曼正筹划脑机接口公司,狙击马斯克的Neuralink

山姆·奥特曼正筹划脑机接口公司Merge Labs,对标马斯克的Neuralink。公司以8.5亿美元估值融资2.5亿,OpenAI或投。此时,二人在X上因苹果推广ChatGPT起争执,脑机接口竞赛也将开启。

AGI Hunt
开源动态8

狂涨34.6K star!!再见了Salesforce,开源CRM标杆,颜值高、功能全,太6了!

传统CRM系统价格高、生态封闭、操作复杂,而开源项目`Twenty`致力于打造现代化、灵活且高度可定制的平台。它功能强大,如可视化流程管理、强大的客户管理等,还提供多种安装方式。

开源先锋
开源动态7

重磅!中国团队发布SRDA计算架构,从根源解决AI算力成本问题,DeepSeek“神预言”成真?

国内玉盘AI团队发布《SRDA AI大模型专用计算架构》白皮书,提出全SRDA计算架构,从硬件源头解决AI算力成本瓶颈。它以数据流为核心,在内存、网络等方面创,为开发者带来高效、低成本等价值。

InfoQ