「可灵3.0」共找到 6096 篇相关文章
本周推荐的5个超级6的Github开源项目!
文章推荐了5个Github开源项目。如htmx,能在纯HTML搞定多种交互,无需JS;Flow.Launcher可快速搜索文件、启动应用;Maple Mono是编程字体,中英2:1对齐;Trilium Notes是分层笔记神器;Hyprnote可实时转录会议内容。
万字长文!大模型LLM推理优化技术总结
文章围绕大模型LLM推理优化技术展开,先介绍LLM推理各阶段、批处理、KV缓存等概念及内存需求,再阐述模型并行、注意力机制优化、模型优化和模型服务等技术,如Pipeline并行、MQA、量化、动态批处理等。
火山引擎发布豆包大模型1.6,加速Agent大规模应用
6月11日,火山引擎举办Force原动力大会,发布豆包大模型1.6、视频生成模型Seedance 1.0 pro等,升级Agent开发平台。豆包1.6表现优异,应用广泛;Seedance 1.0 pro评测领先。还通过创新定价等推动Agent规模化应用。
谷歌Gemini火力全开!实测:原生图像生成新升级确实强
谷歌Gemini原生图像生成功能升级,图像质量更好、文本渲染更准、生成速度更快。可融合图片元素、实时编辑等,能免费试玩,开发者可集成API。实测表现惊艳,也有翻车情况,还能搭配Gemini 2.5 Pro。
ECCV 2026 | 北大团队提出 Atomic Dance:基于原子动作的可解释音乐舞蹈生成框架
北大团队提出 Atomic Dance 框架,以原子动作作为舞蹈基本单元,建立有明确语义和结构的舞蹈表示,设计“动作规划 — 舞蹈生成”两阶段框架,让生成的舞蹈更符合音乐节奏和编舞逻辑,具备可解释性和可编辑性。
一款产品,同时为人类和 Agent 设计,LibTV 是怎么做的?
3月18日,LiblibAI旗下AI视频创作平台LibTV上线,它从设计之初就兼顾人类创作者和Agent。创作者端工作流画布可控;Agent端可通过Skill接口创作,交付可编辑项目。该产品还针对两者差异做了设计,价格也便宜。
首个AI同事正式「入编」!CES 2026超级组织引爆
2026 CES大会上AI成核心主题,出门问问带来TicNote家族‘全家桶’。TicNote Cloud以项目为核心,让AI成团队协作者,其搭载的Shadow AI 2.0能力升级,配合硬件构建端到端工作流,开启协作4.0时代。
老外傻眼!明用英文提问,DeepSeek依然坚持中文思考
DeepSeek-V3.2和DeepSeek-V3.2-Speciale推理能力显著提升,海外研究者用英文提问,它却用中文思考。评论有两种观点,相关论文显示中文省token但非最有效,大模型选思考语言并非只看效率。
「Next-Token」范式改变!刚刚,强化学习预训练来了
微软新研究提出「强化预训练(RPT)」新范式,将下一个 token 预测任务重新定义为推理任务,可利用海量文本数据进行通用强化学习。该方法有可扩展性、低风险等优点,实验显示其提升了语言建模能力。
再见Bug!谷歌超级编码智能体Jules上线,免费使用直连GitHub
谷歌推出编程智能体Jules,进入全球测试阶段,有Google账户的开发者可免费试用每日5次。它基于Gemini 2.5 Pro模型,能写代码、修Bug等,还可连GitHub简化流程,预计今年晚些时候推更多功能和企业版。