「T-Rex」共找到 108 篇相关文章
新鲜出炉!斯坦福2025 CS336课程全公开:从零开始搓大模型
斯坦福大学2025年春季CS336课程“从头开始创造语言模型”课程和材料全公开。介绍了讲师信息,课程目标是引导学生开发语言模型,含5单元19门课,注重实践,还说明了学习该课程需具备的能力。
跨机器、物体与各种任务!RoboScience发布通用具身大模型
RoboScience机器科学发布Visics通用具身大模型并披露VLOA技术架构。该模型从底层搭建全新具身基础表征单元,适配任意机器人、物体和任务。其由具身世界模型和通用操作模型组成,有强大泛化和操作能力。
他们让万亿参数RL学会了「省着跑」,顺便砍掉九成算力
2025年,强化学习成大模型进化主战场,但万亿参数模型跑RL成本高。Mind Lab团队实现1T参数模型LoRA高效RL训练,GPU消耗降90%,技术开源。此外还有Memory Diffusion记忆机制等成果。
突发!字节开源 36B 模型Seed-OSS
字节跳动Seed团队开源Seed-OSS系列36B模型,用12T tokens训练,采用Apache-2.0许可证。该模型能灵活控制推理预算,有两个基座版本,Instruct版在多方面表现强劲,性能碾压OpenAI开源模型。
1句话高质量生成游戏3D动作,北大新方法刷新动画制作SOTA
北京大学提出ReMoMask:基于检索增强生成的Text - to - Motion框架,集成三项关键创新。在标准基准测试上,相比RAG - T2M,在HumanML3D和KIT - ML上FID分数分别提升3.88%和10.97%。
未来两年软件工程展望:从写代码到管 AI,程序员正分化成两种职业
软件行业处在转折点,AI 推动编程变革,企业更重效率。文章围绕五个关键问题展望 2026 年软件工程,分析初级开发者、技能、角色、专家与通才、教育等问题的不同情景,还给出应对建议。
Grok最新模型吃上Cursor「加餐」,马斯克:Coding实现巨大改进
马斯克在X上透露,xAI的Grok基础模型V9 - Medium(1.5T)完成训练,预计2 - 3周后发布,训练加入大量Cursor数据。同时,xAI的AI编程代理工具Grok Build进入早期Beta测试阶段。
消费级具身智能跨越式新品:算力提升1000倍,对标英伟达Jetson Thor芯片,成本仅1/10!
蔚蓝科技发布新款机器狗 BabyAlpha A3,算力提升 1000 倍,对标英伟达 Jetson AGX Thor T5000 芯片,成本仅 1/10。它采用国产芯片,具身智能边缘端混合异构计算集群,感知超人类,实现全自主智能。
告别「边画边说」:LatentMorph 开启视觉生成隐式潜空间推理新范式
现有的文生图模型缺乏动态思考与自我修正能力,香港科技大学团队提出LatentMorph框架,将隐式潜空间推理集成到T2I生成过程中,实验显示其显著提升基座模型性能,削减推理延时与Token消耗,实现人机认知对齐。
中国产业叙事:中际旭创
本文讲述中际旭创发展历程。它原是电机绕组设备厂,2017年收购苏州旭创跨界光通信。借AI算力浪潮,2023年首发1.6T光模块,2024年营收、利润大增,成全球光模块市场榜首企业,还分析了光模块技术趋势。