「豆包大模型2.0」共找到 8904 篇相关文章
训练即服务!让模型训练回归算法语义,150行代码跑通RL
ModelScope团队开源Twinkle框架,采用Client - Server架构,支持20余种算法组件。开发者约150行代码就能编排复杂RL训练循环,底层调度等交给框架。它兼顾易用性与灵活性,有多种特点和优势,代码已开源。
GitHub 狂飙 2.5 万标星,这款「会自愈」的 Python 爬虫框架杀疯了!
GitHub上爆火的Scrapling项目,是自适应Web爬虫框架。它能让爬虫‘学习’和‘适应’,解析器可自动定位元素,请求器能绕过反爬系统,性能强且支持多种会话类型,还能与AI工具集成。
MMLU已死?「人类最后考试」登Nature:全球AI模型集体不及格!
AI发展迅猛,现有基准测试难以跟上其步伐。近1000名研究人员组成的全球联盟创建「人类最后的考试」(HLE),涵盖多领域难题,目前最强AI准确率不足50%,凸显AI与人类专家的差距。
马斯克兑现承诺,开源X推荐算法!100% AI驱动,0人工规则
1月11日马斯克宣布7天内开源X平台推荐算法,如今承诺兑现。新算法由Grok驱动,全AI化,移除人工规则。它双引擎驱动信息流、15种行为预测打分,还揭示过滤机制与设计理念,为创作者提供曝光建议。
1100多个模型殊途同归,指向一个「通用子空间」,柏拉图又赢一回?
约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间,表明架构比数据影响大。此发现能解释诸多现象,还有多种应用可能,但也有局限性。
大模型上天、马斯克发射GPU?中国团队直接建「太空超算」
2025年11月,英伟达送H100入太空,谷歌计划2027年发射81颗搭载TPU的卫星。美国欲打造太空生态闭环,中国中科天算等团队也在行动,中科天算目标是在太空建超算中心。
2.1K star!在终端里丝滑写Markdown,这款平替神器绝了!
Glow是Charm团队开发的命令行Markdown阅读器,解决文档与命令行割裂问题。它功能丰富,支持多平台安装,架构清晰易扩展,适用于开发、运维等场景,相比同类工具优势明显。
从Sora2到TapNow:AI视频创作,差的是这套专业流程
国内知名导演欧阳英豪用AI打造百万级商业TVC,TapNow公开其创作流程。当下AI视频工具强,但能用于商业的TVC少,核心问题是不懂专业流程。TapNow将专业流程工具化,有五大核心功能,适合不同层次创作者。
听了Andrej Karpathy最新2小时访谈,我对Agent彻底祛魅了
Andrej Karpathy在播客中表示,Agent发展还需十年,离像实习生工作还差很远,要解决诸多能力问题;他认为强化学习糟糕但其他方法更糟,还提出AI应削减背书式记忆、未来强大AI或仅十亿参数等观点。
强化学习之父:大语言模型走错了路,不符合「苦涩教训」精神
2024 年图灵奖得主、强化学习创始人之一 Richard Sutton 在播客中批评 LLM 发展方向,认为其无真正智能,违背「苦涩教训」原则,缺乏持续学习能力,仅模仿人类,未理解世界。此观点引发 AI 社区激烈讨论。