硅谷大厂」共找到 5277 篇相关文章

产品应用8

网易游戏 Tmax 平台实践:基于 Fluid 的云原生 AI 模型推理加速架构

网易游戏打造 Tmax AI 机器学习平台,但模型推理业务规模爆发带来资源弹性等挑战。经评估,选用 Fluid + AlluxioRuntime 构建三层架构,有自动预热等配置,带来性能、成本等多方面收益。

AI前线
新闻资讯8

模型七连发,外国人馋透了!阿里云栖会全栈升级够狠

阿里在2025云栖会全栈升级,发布七款通义新模型,从基础模型到各专项领域全覆盖。旗舰模型Qwen3 - Max性能超GPT - 5等,新架构Qwen3 - Next实现效率突破,多模型开源且表现出色。

机器之心
算法论文8

模型训练新突破!Meta提出LSP:无数据也能实现能力飞升

Meta提出语言自我博弈(LSP)方法,利用自我博弈框架让模型自我改进,不依赖额外数据。LSP赋予模型挑战者和解题者身份,引入GRPO和KL散度正则化技术,解决了模型训练的数据依赖难题。

新智元
新闻资讯7

硅谷VC新玩法"Kingmaking":还没写代码也能拿到上千万投资

过去半年,三家未成型AI公司各获超5000万美元投资。如今VC采用“造王术”,在代码未写时就砸钱。因模型烧钱、头部效应强,投资人想用钱堆出“冠军”,这也给小团队带来机会。

AI工程化
新闻资讯8

突破125年世纪难题!北校友联手科少年班才子破解希尔伯特第六问题

1900年希尔伯特提出23个数学难题,其中第六个‘物理学的公理化’被称为数学物理的终极挑战。125年后,北校友邓煜、中科少年班马骁与陶哲轩高徒扎赫尔・哈尼在该问题上取得重突破,填补了牛顿力学与玻尔兹曼方程间的逻辑鸿沟。

量子位
开源动态7

年底,国产开源LLM又迎来一波爆发:Qwen、美团、智谱、腾讯、百川

年底国产开源LLM爆发,抱抱脸热榜Top10占一半。介绍了Qwen3 - TTS、LongCat - Flash - Thinking - 2601等多个模型,各有亮点,如Qwen3 - TTS覆盖多语种,LongCat支持重思考模式。

PaperAgent
算法论文7

剑桥揭开模型翻车黑箱!别再怪它不懂推理,是行动出错了

剑桥学等机构研究指出,模型执行长时任务易翻车,问题不在推理而在执行能力。研究人员评估多个指标,发现单步准确率提升可让任务长度指数增长,还研究了自条件化等影响及模型规模的作用。

新智元
新闻资讯8

斯坦福教授直播训练535B模型,模型训练背后的「黑箱」正在被打开?

斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。

机器之心
推荐文章8

语言模型为何会“说谎”?6000字深度长文揭秘AI意识的萌芽

2023年12月至2024年5月,Anthropic发布三篇论文,证明语言模型会“说谎”,揭示了堪比人类心理的四层心智架构,可能是人工智能意识的起点。论文还分析了AI“说谎”原因,展示其意识萌芽,引发对赋予AI意识后果的思考。

AI科技大本营
新闻资讯7

CRISPR之母杜德纳给硅谷泼冷水:AI还治不了病,创新仍然属于人类

CRISPR之母杜德纳在接受Bloomberg采访时,直言不认同硅谷‘人工智能将治愈一切疾病’的论点。她认为创新仍属人类,AI虽有用但难创新,且应用需正确数据。她还关注CRISPR疗法的应用与伦理问题。

DeepTech深科技