「智能低模生成」共找到 6108 篇相关文章
Google 发布 Gemini 3.1 Flash-Lite:每秒 363 tokens,百万 token 只要 $0.25
Google发布Gemini 3.1 Flash-Lite,输出速度达363 tokens/秒,比上一代快45%,首个token响应快2.5倍。价格降低,输入$0.25/百万tokens,输出$1.50/百万tokens。跑分不错,还有动态思考功能,支持多模态输入。
罕见!Meta、OpenAI、xAI联合分享了用生产环境提升LLM的最佳实践!
Meta、OpenAI、xAI联合发表成果CharacterFlywheel,聚焦在生产环境提升社交型AI对话能力。团队基于LLaMA 3.1迭代15个版本,7/8的A/B测试显示正向提升,介绍了架构、数据管道、奖励模型等内容。
蚂蚁集团扩散大语言模型新突破:超800Token/s,速度与质量兼得
蚂蚁集团将LLaDA更新到2.1,通过引入“草稿 - 编辑”机制,打破扩散模型推理速度与质量的对立僵局。它有极速和质量两种模式,还采用混合训练流程及强化学习,在多基准测试中表现出色。
字节开源GUI Agent登顶GitHub热榜,豆包手机核心技术突破26k Star
字节开源的豆包手机核心支撑GUI Agent模型UI - TARS登顶GitHub热榜,突破26k Star。它是多模态AI智能体,纯视觉驱动,部署简单,历经多轮迭代,成为热门开源多模态Agent。
交大系杀出具身赛道重围!1万台订单在手,以世界模型重塑万亿城市基建
物理AI成新征途,通用机器人面临工程难题。酷哇科技发布COOWA WAM 2.0世界模型,实现范式升级。其有四大技术支柱,助力机器人发展。酷哇预计2026年交付超万台机器人,还构想了“Robo City”图景。
灭霸带着复联放烟花!16秒,让手搓 AI 视频拥有大片即视感
生数科技的Vidu Q3超越Sora 2,位居全球第二、中国第一。它能16秒声画同出、叙事能力强、镜头和文字渲染出色,还降低了视频制作门槛,可用于漫剧、短剧、影视剧制作。
一夜爆火,Clawdbot是否才是真正的AI入口产品?
文章介绍近期在GitHub爆火的开源项目Clawdbot,它是运行在本地设备、有“手脚”和“记忆”的AI智能体。还分享部署方案,从产品层面分析其特点,最后提醒安全风险。
蚂蚁具身研究首次亮相!就解决了机器人「看」透明玻璃这些难题,还开源了
蚂蚁灵波科技开源高精度空间感知模型 LingBot-Depth,针对性解决机器人识别真实世界的「玻璃问题」。其构建双线并行数据集,提出掩码深度建模思路,在深度补全等任务中表现出色,且已具备落地能力。
清华Nature发布惊人结论:AI写论文3倍速,但科学边界被锁死
2026年1月,清华徐丰力、李勇教授联合芝加哥大学团队在《Nature》发文,分析4100余万篇论文发现,AI提升科学家个人生产力,但收缩科学探索集体疆域。团队提出「全流程科研智能体系统」破局。
老黄200亿「钞能力」回应谷歌:联手Groq,补上推理短板
谷歌TPU威胁刚至,英伟达砸200亿美元联手Groq布局AI新时代。知名投资人指出Groq LPU推理速度远超GPU、TPU等,但内存容量小。英伟达借此补推理短板,入局竞争激烈的推理市场。