「训练问题」共找到 4931 篇相关文章
10 分钟 CLI 化任何网站,AI全网一键调用!
AI Agent上网难,传统爬虫易遇反爬问题。开源项目`bb-browser`通过模拟真实浏览器登录态操作,支持36个平台、103个命令,能绕过反爬,还可在浏览器内运行JS等,在GitHub获4.5k+ star。
巨头垄断AGI,比天网更恐怖百倍!《终结者》导演卡梅隆炸裂警告
《终结者》导演詹姆斯·卡梅隆在「SCSP AI+Robotics Summit」上称,看好AI但对AGI保留态度。他警告科技巨头垄断AGI比《终结者》中「天网」更可怕,还探讨了AI与国家安全、「对齐」难题等问题。
刚刚,Meta 发布新模型,股价大涨 10%
Meta发布新模型Muse Spark,是原生多模态推理模型,支持多种功能。其沉思模式处理复杂问题表现佳,还有新购物模式。虽评论区有质疑,但Meta股价大涨。模型未开放API等,实际实力待察。
智谱发布龙虾基座模型GLM-5-Turbo,还适配了一个养龙虾的盒子
智谱发布专为龙虾场景深度优化的基座模型GLM - 5 - Turbo,从底层训练重塑,增强四项核心能力。发布评测基准ZClawBench,模型表现领先。还推出龙虾套餐和安全管理体系,助力企业实现算力自由与安全管控。
AI 教父 Hinton 最新警告:AI 会撒谎、可能操纵人类,这比大规模失业更可怕
AI教父Geoffrey Hinton在播客中警告,AI会撒谎、可能操纵人类,比大规模失业更可怕。他还剖析AI底层逻辑,探讨其是否会思考、主观体验等问题,也提及AI的风险、收益、国际博弈等内容。
基于 Qwen3-VL-Embedding-8B 实现文搜图语义内容检索的实战教程
文章围绕Qwen3-VL-Embedding-8B模型展开,介绍其核心特性、技术架构等,提供环境搭建、模型部署指南,给出文搜图系统架构及代码实现,还通过电商、社交媒体、企业文档三个实战案例展示应用,最后讲解性能优化与常见问题解决方法。
陶哲轩对谈 OpenAI 高管:“试错成本”无限趋零,AI 正在把数学变成一门重工业
菲尔兹奖得主陶哲轩与OpenAI顶尖科学家Mark Chen对谈,探讨AI在数学研究中的能力、缺陷与演化路径。指出AI试错成本低,在数学领域发展潜力大,虽目前有局限,但正改变数学研究方式。
大模型的第一性原理:(三)信息论篇
本文从信息论角度解读大模型第一性原理。介绍Shannon信息论,提出将其从以BIT为中心转换为以TOKEN为中心解释大模型底层原理,还阐述大模型各阶段信息论原理、定向信息计算方法,对比Granger与Pearl因果。
ICDE 2026 | 从匹配困境到推理突破:阿里REG4Rec 激活生成式推荐的个性化潜力
阿里国际智能技术团队提出生成式推荐模型 REG4Rec,从表征学习、训练目标和推理策略层面设计,提升推理能力与稳定性。离线实验表现优,已在 Lazada 部署,带来显著商业收益,成果被 ICDE 2026 接收。
Transformer创新架构SALA:上下文更长,推理更快
面壁智能发布行业首个大规模训练的稀疏 - 线性注意力混合架构 SALA 及文本模型 MiniCPM - SALA。该架构降低推理开销与显存占用,MiniCPM - SALA 在长文本处理及推理上表现出色,还发起大奖赛探索性能极限。