全4比特量化」共找到 1993 篇相关文章

开源动态8

刚刚,DeepMind开源栈「Deep Research」项目,AI 研究将人人可用

谷歌DeepMind团队开源基于Gemini 2.5的栈「Deep Research」项目,能让每个人拥有智能研究助手。它可动态搜索、反思结果,以流式传输提供带引用答案,前后端结合,还介绍了特性、原理、技术栈等。

AGI Hunt
开源动态8

无需任何 API 费用,这个Agent 拥有“看遍网”的超能力

AI Agent 在网络信息获取上存在诸多难题,而 Agent Reach 能解决这些问题。它免费开源、安且持续更新,兼容所有 Agent,支持多平台。安装简单,装好即可用,各渠道还能灵活替换。

GitHubStore
新闻资讯8

震撼网!3位00后夺200万大奖,卷走鹅厂顶级Offer

历经四个月,「腾讯广告算法大赛」战果揭晓,「Echoch」战队夺冠,另有两支战队杀入三甲,前十名员获鹅厂Offer意向书。赛事揭示推荐系统正迈入「端到端生成」新纪元,各战队方案亮点多。

新智元
新闻资讯7

Claude骂声中启动「隐形水印」:新模型量嵌入,标记所有文字

Anthropic宣布新款Claude将在生成文本中嵌入隐形水印,还会给特定文件附加数字签名元数据,球统一施行。此前A社就用Unicode贴暗标,虽称不影响生成质量,但遭质疑。

量子位
开源动态8

卡帕西没做完的,开源社区48小时搞定了!完体知识库,token省70倍

Karpathy分享的个人知识库爆火,48小时后开源社区推出Graphify工具。它零配置、模态、本地跑,能自动构建知识图谱,省71.5倍token,还平台适配,降低了上手门槛。

量子位
开源动态7

直播预约 | LightMem:面向大模型的轻量化可插拔记忆系统

本报告聚焦大语言模型长期记忆构建与轻量化机制。现有外部记忆系统有记忆臃肿、组织低效、更新代价高问题。为此提出LightMem架构,能为大模型提供轻量、高效、可扩展记忆组件。

深度学习自然语言处理
开源动态8

清华SageAttention3,FP4量化5倍加速!且首次支持8比特训练

清华大学陈键飞团队提出针对BlackWell架构的SageAttention3,实现5倍于FlashAttention的推理加速,首次支持8比特训练。在多种大模型上保持端到端精度,代码将分别于6、7月开源。

机器之心
产品应用7

IDE?字节TRAE搞了个大升级,现在能流程开发了

国内首个原生AI IDE TRAE推出SOLO正式版,升级为集成多智能体协同架构与流程开发工具链的AI协作平台。新增SOLO Coder智能体,三栏布局更高效,升级思路贴合开发者需求。

量子位
产品应用8

行业的「龙虾热」中,什么是AI Infra下半场的「神之一手」?

OpenClaw爆火,标志AI进入「自主执行时代」,但面临安、资源利用和并发规模等挑战。腾讯云Agent Runtime为企业级AI智能体打造专业支持,解决状态管理和行为治理难题,还助力MiniMax突破性能瓶颈。

机器之心
新闻资讯8

313页的StateofAI2025报告解读:今年AI圈发生了什么

本文解读了313页的《State of AI 2025》报告,回顾去年预测,盘点今年AI圈大事,如DeepSeek崛起、OpenAI开源、NVIDIA循环投资等,还提及AI安、数据使用情况,最后给出2026年10个预测并为普通人提供关注建议。

花叔