「新能安」共找到 7855 篇相关文章
从 ReasoningBank 到 MetaAgent,RL 未必是 Agent 自进化的必要解?
业内对智能体自进化的探讨开启多路线探索模式。除 RL 优化,记忆系统改进成新方向,如 ReasoningBank 机制。此外,业内还从智能体自我识别、工具和策略辅助等机制探索其他技术路线。
最强开源0.9B级OCR模型!本地Agent、知识库都有救了!
百度飞桨PaddleOCR团队开源多模态文档解析模型PaddleOCR-VL,参数量仅0.9B,对算力要求低。它在OmniDocBench V1.5榜单屠榜,经测试,能精准识别发票、图表等,适合本地环境与资源受限设备。
Google 推出了免费 Vibe Coding 工具,一键集成聊天、视频、图像AI,真的很氛围。
谷歌推出免费 Vibe Coding 工具,集成多种 AI 功能。谷歌 AI Studio 的 Built 模式更新,能混合匹配 AI 功能,自动连接模型和 API。用户无需了解 API 文档,可快速做出 MVP,谷歌 AI API 免费(限速)。
当下的 AI 产品:有 revenue,但不是 recurring 的
当下AI创企有收入但非经常性,ARR指标被扭曲。因定价权在巨头手里,传统SaaS的ARR已不适用。初创生态封闭循环,未来ARR可能不再是评估方式,新指标或聚焦留存率等。
「从追赶者到引领者,路有多远?」 我们和CANN一线开发者聊了聊
AI浪潮下,硬件竞争转向软件等生态之战,华为昇腾及其CANN站在变革前沿。本文与开发者对话,探讨CANN开源意义、早期挑战、演进及未来战略,开源将带来技术透明、生态赋能等红利。
代码生成要变天了?被质疑架空后,Yann LeCun携320亿参数开源世界模型“杀回来了”
美国当地时间9月24日,Yann LeCun团队发布320亿参数代码世界模型CWM。它创新训练方式,能模拟代码执行。性能测试表现出色,还开放检查点。Meta AI业务重组,CWM发布或表明未彻底放弃开源。
超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破
文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销大、推理延迟高问题,提出两大创新,在LIBERO实验中性能超经典模型,还实现推理加速。
ChatGPT到底学了多少「污言秽语」?清华团队首提大语言模型中文语料污染治理技术
清华等团队研究发现,先进ChatGPT系列模型中文词表污染达46.6%,含色情、赌博等词元。团队定义分类中文污染词,构建识别模型,还能由词表污染估计数据污染,为语料治理提供方案。
Altman 秀新模型“翻车”,谷歌补刀躺赢!OpenAI 前员工爆肝3天,编程再赢老东家模型!
近期 OpenAI 多款未发布新模型登场,一款疑是“伪装的 GPT - 5”,一款编程赛获第二。宣称在 IMO 获金牌的模型遭质疑,谷歌 DeepMind 同获金牌评价更好。OpenAI 前员工编程赛赢老东家模型。
Stream-Omni:同时支持各种模态组合交互的文本-视觉-语音多模态大模型
中国科学院计算技术研究所团队提出文本-视觉-语音多模态大模型Stream-Omni,能支持多种模态组合交互。它对各模态关系针对性建模,实现高效灵活的模态对齐,仅用少量语音数据就有多种交互能力。