「LLaDA 1.5」共找到 3233 篇相关文章
全网疯抢体脂秤背后,阿福找到了健康 AI 的正确打开方式
6月25日,蚂蚁阿福发起‘科学减重1亿斤’行动,1分钱发放AI体脂秤引疯抢。它支持测18项身体数据,还能接入多种健康硬件。阿福用医疗大模型提供个性化方案,走出全民普惠的AI健康管理道路。
I/O大会开完,谷歌连搜索框都变智能体了
当地时间周二谷歌I/O大会举行,转型智能体时代。谷歌推出Gemini 3.5系列模型,轻量级3.5 Flash已开放,重量级3.5 Pro仍在开发。还发布全新AI智能体Spark,改造谷歌搜索,推出多模态模型Gemini Omni。
大模型追逐星辰大海,GPT和Gemini国际天文奥赛夺金
新论文以国际天文学和天体物理学奥林匹克竞赛 (IOAA) 为基准测试,证明 GPT - 5 和 Gemini 2.5 Pro 能在天文奥赛获金牌。研究还分析不同模型表现、与人类成绩对比及错误类型,强调需全面评估模型科研潜力。
不卷速度卷验证,陈天桥MiroMind精准预测15天后黄金价格
陈天桥带队的MiroMind发布新一代重型推理智能体MiroThinker-1.7和MiroThinker-H1,在基准测试中表现优异,超越众多顶尖模型。该模型不仅通用任务强,在科技金融等专业领域也表现亮眼,还能承担真实长链条智力任务。
野生DeepSeek火了,速度碾压官方版,权重开源
近日,德国AI咨询公司TNG推出的「DeepSeek R1T2」模型火了,速度比R1快20%,性能不弱于R1。它采用AoE技术,融合官方三大模型,开源且在Hugging Face开放权重,获不少人期待。
里程碑时刻!首个100B扩散语言模型来了,技术报告揭秘背后细节
蚂蚁集团与高校联合团队推出 LLaDA2.0 系列扩散语言模型,其中 LLaDA2.0 - flash 参数量达 100B。技术报告披露细节,其解决了 dLLM 做大做强难题,性能比肩 AR 模型,为扩散模型工业化带来转机。
1人1假期,肝完10年编程量!马斯克锐评:奇点来了
硅谷大佬新年收假分享编程Agent提效成果,Midjourney创始人假期编程量超过去10年,马斯克称进入奇点。多位工程师也有类似体验,Claude在编程方面表现出色,国产字节TRAE中国版SOLO全量免费开放。
AI 基础知识从-1到0.1:带你走进机器学习的世界
文章沿着AI发展脉络,从Seq2Seq到GPT模型,深入介绍关键技术原理。以简明方式梳理AI基础概念,涵盖人工智能、机器学习等定义,还介绍了各类学习方法、特征工程及向量化等内容,最后提及模型应用流程和Quick BI助力企业分析。
智谱AI、清华开源新视觉大模型:刷新41项纪录,同级别最强
智谱AI与清华联合开源GLM - 4.5V视觉大模型,它基于GLM - 4.5 - Air开发,架构独特。在42项主流测试中创41项新纪录,多领域表现超Qwen2.5 - VL等模型,还采用新训练策略。
Claude第一款AI桌宠硬件,深圳制造
Anthropic的开源项目Claude-Desktop-Buddy,首款AI桌宠硬件用深圳M5Stack的M5StickC Plus。A社选它或因工程师是用户且新款常断货,也因其文档和代码可靠。深圳供应链强,M5Stack调整使命为AI世界准备基建。