大模型更新」共找到 9455 篇相关文章

开源动态8

DeepSeek开源新模型,提出上下文光学压缩:LLM的新记忆方式

DeepSeek开源OCR模型,探索用多少视觉信息让LLM理解文本。实验表明1000字文档约需100个vision tokens,压缩比10倍、准确率97%。还提出模拟人类遗忘等想法,有多种应用场景,且完全开源。

花叔
开源动态8

故障率降低100倍,微软突破性技术破解AI算力浪费难题

在AI数据中心,网络链路高故障率制约算力释放。微软在“ACM SIGCOMM 2025”会公布MOSAIC技术,将链路故障率降100倍,实现50米长距传输、最高68%功耗降低,为规模AI集群提供支撑。

AIGC开放社区
新闻资讯7

彻底封杀!Anthropic第四刀砍向龙虾,开发者哀嚎,两创始人互喷!

前天Anthropic封杀OpenClaw订阅额度后,24小时内又在官方轻量化命令行工具查人,提示词含“OpenClaw”就返回400错误。两负责人隔空交火,开发者各寻出路,这或成Anthropic战略失误。

鲸选AI
新闻资讯7

突发!xAI联创杨格过劳病离职,给马斯克干活压力山

xAI联创杨格因长期高强度工作患莱姆病离职。此前已有多位核心成员离开。马斯克强调速度的管理风格使员工压力,其公司高管更迭率高,不过也有人认为这能筛选出能力强的成员。

量子位
新闻资讯7

AI行业的底牌已经亮完了,模型能力趋同后,拼什么?

Databricks MVP Adi Polak分析AI人才需求,指出能搭建评估管道等的工程师是硬通货。前沿模型架构趋同,行业从技术竞赛转向生态战争,比拼产品和用户理解能力,还为转型工程师给出建议。

AI工程化
算法论文8

行为记忆+认知记忆,中科MemWeaver重构LLM个性化记忆

论文MemWeaver被The Web Conference 2026接收,它聚焦用户从隐式到显式文本交互时个性化生成的升级问题。提出将用户历史升级为层次化记忆,构建行为与认知双记忆模块,主实验表现优,消融实验验证其结构设计关键。

PaperAgent
开源动态8

开源 Paper2Slides,一条命令,把论文变成专业幻灯片!

在AI辅助办公赛道,PPT生成一直是竞争热点,但存在好看不好用、好用不准确的问题。港开源的Paper2Slides项目,能一条命令把论文转成专业幻灯片,还能做海报,解决了AI幻觉问题。

开源星探
新闻资讯7

Grok最新模型吃上Cursor「加餐」,马斯克:Coding实现巨改进

马斯克在X上透露,xAI的Grok基础模型V9 - Medium(1.5T)完成训练,预计2 - 3周后发布,训练加入量Cursor数据。同时,xAI的AI编程代理工具Grok Build进入早期Beta测试阶段。

量子位
推荐文章7

Sebastian Raschka 2026预测:Transformer统治依旧,但扩散模型正悄然崛起

知名AI研究员Sebastian Raschka预测2026年,Transformer架构在未来至少一到几年仍占统治地位,但会在效率和混合上微调。同时,扩散语言模型虽有工具调用缺陷,但在数据稀缺时或成更好的学习者。

机器之心
新闻资讯8

GPT-5.4发布:OpenAI首个一统模型,简直是龙虾原生

OpenAI发布GPT - 5.4,这是其首个一统模型,将推理、编程等能力融合,且单项性能领先。它在知识工作、计算机使用、编程调试等能力提升,定位AI数字员工,虽单价高但有省钱机制。

量子位