FP4训练」共找到 3427 篇相关文章

产品应用8

MoE不够看了,腾讯推出MoT:2B具身模型22项评测16项最佳

腾讯混元团队联合Robotics X实验室推出HY - Embodied - 0.5系列基础模型,含MoT - 2B和MoE - 32B两款主力模型。在22项评测中,MoT - 2B获16项最佳,其架构、数据和训练有创新,能应用于机器人控制。

量子位
产品应用8

小模型,大能量!200美金的GPT Pro竟然输给了它?

博主用11个场景深度测试昆仑万维的Skywork R1V4 - Lite,它能做到Gemini 2.5 Pro才能干的事,速度快、成本低。在定位、人物识别、生活实用、专业鉴定、学术研究等场景表现出色,核心突破在于主动图像操作与深度推理。

AI产品黄叔
新闻资讯7

7个AI玩狼人杀,GPT-5获断崖式MVP,Kimi手段激进

OpenAI总裁转发基准测试,让7个LLMs玩210场狼人杀。GPT - 5胜率96.7%断崖式领先,国产Qwen3和Kimi - K2分列第4、6。测试方分析模型性格,还借此研究LLMs社会行为,长远目标是实现AI驱动的市场研究。

量子位
新闻资讯7

GPT-5被批过度炒作、性能落后,OpenAI联创揭秘其中原因:我们把它关在 “象牙塔”,和现实世界接触不够

OpenAI 发布 GPT - 5 进军企业市场,虽发布不顺利,但部分初创公司和企业客户反馈其在复杂任务表现出色、价格低廉。OpenAI 联创 Greg Brockman 揭秘 GPT - 5,称其代表‘几乎难以形容的智能’,是科研好伙伴,还探讨算力、模型训练等问题。

InfoQ
推荐文章8

八年孤独,Iceberg 赢得世界

本文讲述 Iceberg 的发展历程、技术特性、用户案例及商业生态。它从解决 Hive 痛点孵化,经开发者、客户、厂商推动成开放表格式标准。其 V3 Spec 补充短板,社区开始构想 V4 。诸多科技大厂深度使用并贡献代码。

InfoQ
开源动态8

GLM-5.1夺开源模型第一,长程任务更稳,一句话就能生成文章短视频

智谱官宣GLM-5.1开源,代码能力增强,在三项代码评测基准综合平均分上,取得全球模型第三、国产及开源模型第一。它专为长程任务设计,能8小时持续工作,还能一句话生成短视频,是平替Claude Sonnet 4.6的优选项。

AI工程化
新闻资讯7

字节阿里DeepSeek决战春节:一场关乎14亿人的重磅AI大战

春节将至,字节、阿里和DeepSeek间的AI大战拉开帷幕。字节将推三款多模态旗舰模型;阿里或发布Qwen 3.5,让千问打通支付与电商;DeepSeek V4或携强代码能力突袭。这是对用户生活入口和互联网秩序的争夺。

新智元
产品应用7

14万,家务机器人带回家!斯坦福华人博士具身创业首款产品亮相

斯坦福明星华人博士生创业机器人Memo亮相,售价2万美刀。它颜值高,能做家务,在无剪辑等的demo中有出色表现。其背后是ACT - 1模型,依赖技能捕捉手套数据训练,成本低且用户可教它新本领,预计2026年推出。

量子位
算法论文8

世界模型迎来因果升级:CD-LAM仅用几千步微调即可显著增强动作控制

Aether AI与加州大学圣地亚哥分校研究发现现有世界模型会无视动作控制信号,根源是隐动作模型受视觉混杂因素污染。团队提出CD - LAM,从上游净化隐动作表征,实验显示其能降动作误差、提画面质量,降低后训练开销。

机器之心
新闻资讯8

刚刚,智谱港交所敲钟!市值528亿港元

智谱在港交所敲钟上市,成全球首家AGI基座模型上市公司,首日市值超528亿港元。其IPO受热捧,资本阵容强大。新一代模型GLM - 4.7表现出色,营收增长快,大部分资金用于研发,标志中国大模型迈向全球竞技。

量子位