「两小时学习法」共找到 2362 篇相关文章
具身智能的“生命线”:数据基石与未来路径 | GAIR Live 017
雷峰网举办具身智能数据线上论坛,三位嘉宾探讨其从数据采集到闭环学习全过程。指出具身智能数据挑战严峻,分享真机数据稀缺解决方案,认为仿真合成数据是必经之路,还谈及产学协同、数据服务等内容。
马斯克「世界模拟器」首曝,1天蒸馏人类500年驾驶经验!擎天柱同脑进化
特斯拉官宣「世界模拟器」,可模拟、合成自动驾驶的「孪生世界」,生成不同视角和长尾场景。它基于端到端神经网络,有学习人类价值观等优势。还能用海量数据解决难题,输出可解释中间结果,为自动驾驶和擎天柱训练服务。
奥特曼「一张脸」引爆全球狂欢!Sora 2冲上APP榜第三,邀请码炒到1250元
Sora 2上线不到24小时冲上苹果商店榜单前三,其「1换4」邀请码机制和「Cameo自我上传」玩法引发社交传播热潮,邀请码被黄牛炒作。同时,它也引发OpenAI内部争议,CEO奥特曼为其辩护。
清华开源首个股票k线大模型
清华开源首个股票K线大模型Kronos,是专为金融市场K线序列预训练的模型,处理金融数据高噪声特性。采用两阶段框架,有安装、预测步骤,还有批量预测方法,项目地址为https://github.com/shiyu-coder/Kronos。
刚刚,GPT-5首次通过「哥德尔测试」!破解三大数学猜想
GPT - 5首次通过「哥德尔测试」,破解三大组合优化猜想。研究由海法大学和思科主导,团队设计五项测试任务,GPT - 5在三个简单问题上近乎完美,还推导出不同解法,标志AI从「学习数学」迈向「做数学」。
Mira Murati 创业公司首发长文,尝试解决 LLM 推理的不确定性难题
OpenAI前CTO Mira Murati创立的Thinking Machines Lab首发文章《克服LLM推理中的不确定性》,指出大语言模型推理难获可复现结果,深入探究其不确定性根源,提出使核函数具备批次不变性的方法并给出实现与实验。
Claude Code 实战横评:GLM4.5 vs DeepSeek 3.1(附Windows MCP配置,免费模型接入)
文章对Claude Code里GLM4.5和DeepSeek 3.1进行实战横评,涵盖数据库、网站、游戏等测试案例。还介绍Claude Code在Windows下配置MCP经验,以及接入GLM、Deepseek等模型的方法和免费平台。
软件行业“快时尚化”背后的经济学 | AGIX PM Notes
本周市场对软件看法悲观,OpenAI CEO 警告软件或进入‘快时尚时代’。但软件行业会升维,一是从‘死’变‘活’,具备元学习能力;二是定价更极致。还介绍了本周市场总结及多起 AI 相关企业动态。
DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO
文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。
The Batch: 859 | Qwen3 的自主智能新进展
不到两周前 Kimi K2 超越其他开源非推理模型,如今阿里巴巴发布基于早期 Qwen3 - 235B - A22B 的三款新大语言模型权重,介绍了输入输出规格、架构设计、性能表现、使用方式等,还进行了性能对比。