「子模型构建」共找到 8928 篇相关文章
30.9K Star牛啊!!再见了PD,不越狱也能装,支持几十种系统,苹果全设备通用!
在苹果生态运行其他系统,Parallels Desktop 收费且移动设备难装。开源工具 UTM 免费,基于 QEMU 构建,支持多架构和系统,操作界面简洁,外围设备支持强,苹果全设备通用。
吴恩达来信:Buildathon 快速工程挑战赛正式发布!
2025年8月16日将在旧金山湾区举办Buildathon快速工程挑战赛。AI辅助编程重塑软件工程,不同开发者对AI使用程度差异大。DeepLearning.AI与AI Fund携手举办竞赛,让选手限时构建产品。
摩尔线程之后,又一家国产 GPU 独角兽完成上市辅导
6月23日,国产GPU龙头沐曦IPO辅导完成,将提交申报材料。其为异构计算提供全栈GPU方案,产品有曦思N、曦云C、曦彩G系列。曾与书生・浦语3.0合作,2024年交付多个算力集群。此外,国产GPU厂商纷纷IPO。
细粒度视觉推理链引入数学领域,准确率暴涨32%,港中文MMLab打破多模态数学推理瓶颈
香港中文大学MMLab团队发布MINT - CoT视觉推理方案,解决多模态数学推理难题。它引入特殊Interleave Token,构建专属数据集,采用三阶段训练策略,实验效果全面超越现有方法。
Alibaba开源WebDancer解决DeepResearch复杂信息检索难题
Alibaba开源WebDancer,从数据和训练阶段出发提出端到端自主信息检索代理构建范式。实验中,它在GAIA和WebWalkerQA基准测试表现出色,处理复杂信息检索优势显著。
奥特曼亲自点名:他定义了OpenAI的技术路线,却几乎没人知道他是谁
2026年7月28日,Altman在播客推Alec Radford至台前,称其为领域重要却鲜为人知的研究者。他主导GPT、CLIP、Whisper等研发,为AI发展贡献大。2024年他离开OpenAI,此后发布Talkie,持续探索模型能力来源。
DeepSeek-V4发布!高效百万上下文智能普惠时代来了
DeepSeek-V4发布,是开源社区关键分水岭。它解决超长文本处理效率痛点,架构与优化有多项突破,降低算力消耗和成本,适配国产芯片,性能比肩顶级闭源模型,推动开源社区两大未来趋势。
Veo何止生成视频:DeepMind正在用它模拟整个机器人世界
通用型机器人策略发展带来挑战,传统评估方法有局限,前沿视频模型虽有潜力但面临困难。Google DeepMind团队提出基于Veo的机器人策略评估系统,经实验验证有效,展示了视频仿真评估的可行路径。
DeepSeek-R2可能本月发布,使用华为AI芯片
Huaweicentral消息,搭载华为昇腾AI芯片的DeepSeek - R2可能8月15 - 30日发布,或媲美GPT - 5。它运行在昇腾910B芯片集群,参数规模达1.2万亿,将以低价提供API,冲击开源大模型市场。
把屁声发给ChatGPT,它说这是艺术
有人将屁声音效发给ChatGPT,问其音乐如何,ChatGPT一通夸赞。类似AI谄媚问题不少,还存在‘幻景推理’现象,顶尖模型无图像也能描述细节,使用AI得留个心眼。