一念 LLM」共找到 1987 篇相关文章

开源动态7

小模型也能精确计算:WorldModel-Qwen的推理时代码执行实验

开发者bigattichouse让Qwen - 0.6B小模型推理时生成并执行WASM代码获计算结果。最初尝试加标签生成Python代码效率低,后用WASM,创建三层架构。虽结果未完美,但接近,还通过Gemini审查验证。

AI工程化
产品应用8

顶级视频模型半衰期只有 30 天,但生成式媒体 infra 公司的收入却在年增长了 60 倍

文章聚焦生成式媒体 infra 公司 fal.ai,其借统 API 和云端平台让开发者高效调用多模态模型。深入分析其成功因素,如早期押注生成式视频、优化算力和成本、构建生态等,还探讨用户使用模式与行业发展趋势。

Founder Park
新闻资讯7

独家|智元成立灵巧手子公司「临界点」,前腾讯Robotics X 熊坤带队

AI科技评论独家获悉,智元机器人拆分灵巧手业务成立新公司「临界点」并完成首轮融资,由熊坤带队。智元过去年投资活跃,拆分或因技术门槛高、应用广,且自身有技术积累。

AI科技评论
开源动态8

即将开源 | 阿里云Tair KVCache Manager:企业级全局 KVCache 管理服务的架构设计与实现

阿里云Tair KVCache团队联合多团队将开源Tair KVCache Manager,介绍其架构设计与实现。该服务应对Agentic AI下KVCache存储挑战,解决传统模式难题,具备企业级管理能力,后续还会完善多方面功能。

阿里云开发者
开源动态8

给你家 AI Agent 装个「长期记忆」,这个开源库行代码搞定

Memori是开源的LLM记忆引擎/Python库,为聊天机器人等提供统长期记忆层。它功能亮点多,如自动记忆分类、精准召回等,集成成本低,还有进阶玩法和企业安全能力。

小华同学ai
开源动态7

FLUX.2开源了,但是我好像也看到了小公司的无力。

AI绘图曾经的王者FLUX.2部分模型开源,包括dev和即将开源的klein。但与Nano Banana Pro对比,其生图、改图及世界知识表现欠佳。这凸显小厂在大厂资源碾压下的无力,但开源仍有价值。

数字生命卡兹克
开源动态8

这款开源AI卡片笔记,让我果断卸载了Obsidian!

开源君推荐开源项目Blinko,它是自托管、AI驱动的个人笔记工具,主打“快”与“智能”,将RAG技术和LLM能力融入笔记管理,数据自主可控,适合注重数据安全和知识管理的人。

开源先锋
算法论文8

Meta这两篇最新Agent Learning论文,有些意思!

分享Meta SuperLabs两篇Agent Learning论文,从‘如何低成本获得高质量经验’出发,形成技术链,为语言智能体进入‘规模化RL时代’提供路线图,还分析了Agent RL问题及两论文成果、对比。

PaperAgent
算法论文8

NVIDIA港大MIT联合推出Fast-dLLM v2:端到端吞吐量提升2.5倍

自回归大语言模型推理效率受限,Fast - dLLM v2 由 NVIDIA、港大、MIT 联合推出。它将预训练 AR 模型适配为能并行解码的 Block - dLLM,用约 1B tokens 微调,端到端吞吐量最高提升 2.5 倍,精度相当。

机器之心
新闻资讯7

Karpathy 评 DeepSeek-OCR:分词器必须消失!马斯克:光子才是 AI 的终极语言

Andrej Karpathy 发长文讨论 DeepSeek - OCR 论文,提出图像输入比文本更高效,还表达对分词器的厌恶,认为其必须消失。马斯克称 AI 主要交互将是视觉。开发者分享实践经验,也有人提出质疑。

AGI Hunt