「通用推理」共找到 2676 篇相关文章
撞名Anthropic的“外挂”刷屏:让“DeepSeek V4‑Pro碾压 Fable 5”但无人能复现,Token开销反而翻倍
J - Space Cognition Suite社区项目在X上传播,称不修改DeepSeek V4 - Pro模型权重,用推理时Harness能提升其在多项Agent Benchmark表现,超Fable 5,但未第三方复现,且Token开销可能翻倍。
落地商用开启国产一体化智算新时代,蓝芯算力LX500亮相滴水湖RISC-V产业论坛
2026年8月13日,第五届滴水湖中国RISC - V产业论坛召开。蓝芯算力生态营销负责人许庆伟以核心产品LX500为线索,从架构、算力、商业落地三方面,展示国产RISC - V算力商用路径。
国产开源新突破!5万小时真机数据,撕开行业最大痛点
蚂蚁灵波开源具身操作基座模型LingBot-VLA 2.0,用同一套模型「驯服」20种机器人构型。它覆盖5万小时真机数据,在通用泛化能力上全面升级,还带来三大底层技术革命,可降低重复适配成本。
AI 时代,实时入湖正在告别 ETL:从 Kafka 到 Iceberg 的架构减法
在AI驱动的数据应用场景中,Kafka、Iceberg开放表格式与对象存储组合成流数据入湖重要方向。传统ETL方式有链路长等问题,文章围绕“零ETL”讨论架构减法,介绍Kafka × Table Bucket方案及优势、适用场景。
抢疯了!AI宠物翻译器:800多块,预售2万单
PettiChat宠物翻译器售价800多,预售2万单。它能将猫狗叫声转成句子,翻译延迟1.2秒,还具备位置追踪、安全警报和声音克隆功能。其靠大模型的声音识别和情绪推理系统实现翻译。
抢先李飞飞!世界模型能多人联机玩FPS游戏了
Odyssey公司推出世界模型Agora - 1,驱动网页版多人FPS游戏,无游戏引擎等,画面实时生成。该公司专注通用世界模型,此前业务转向主动交互,此成果解决多人游戏一致性难题,还发布多模态模型Starchild - 1。
哈佛《Science》研究:大模型已碾压人类医生!
哈佛医学院等团队让OpenAI o1系列大模型与数百位医生在多项测试中较量,大模型在各项诊断和管理推理任务上全面超越人类专家,不过当下模型处理非文本信号有局限。
揭秘大模型Steering:从底层机理到系统评估,全面破解大模型行为控制之谜
近期《Science》研究表明可解析AI内部表征实现通用引导与监控。浙大联合阿里两篇ACL 2026主会论文,揭示Steering工作原理与能力边界,还开源一站式框架EasyEdit2,全面展示了Steering价值。
大佬深度解析:Coding Agent的底层运行逻辑是什么?
本文由AI领域知名学者Sebastian Raschka撰写,探讨编码智能体及其编排的设计、工作原理和组件协同。指出智能体周边支撑系统重要性不亚于模型本身,详细阐述编码智能体六大核心构建模块。
内存股集体大跌,原因竟是谷歌这篇一年前的论文
美国内存股集体暴跌,诱因是谷歌新博客介绍一年前公布的技术 TurboQuant。它是压缩算法,可大幅减少 LLM KV 缓存内存占用、提升速度且精度零损失,有望打乱市场对内存芯片增长预期。