「无预训练模型」共找到 8602 篇相关文章
一文读懂DeepSeek-V3.2核心技术DSA:API疯狂降价性能不减的背后
DeepSeek发布实验模型DeepSeek V3.2,引入自研稀疏注意力机制DSA,API价格最高降75%。DSA先筛选后计算,含闪电索引器和稀疏多潜在注意力两组件,分四步工作,权衡了精确性与速度。
LLM开源2.0大洗牌:60个出局,39个上桌,AI Coding疯魔,TensorFlow已死
9月13日蚂蚁集团开源团队发布LLM开源2.0全景图,收录114个项目,39个新晋、60个出局。生态洗牌,Agent层活跃,分类架构细化。AI Coding等领域发展显著,TensorFlow不敌PyTorch,还梳理厂商大模型发布情况。
准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了
OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。
ACL 2025 高分接收 | 高感情语音技术:逻辑智能小语种TTS破局之道
语音合成技术在大语种发展好,但小语种因语料稀缺等面临挑战。逻辑智能团队提出针对低资源语言TTS的解决方案,构建泰语数据集,经先进预处理,其TTS模型效果好,有零样本克隆能力。
独家丨清华00后团队「零次方机器人」获超亿元融资,聚焦可真实落地的具身智能
AI科技评论独家消息,零次方机器人近日完成超亿元融资,由润泽集团领投。该公司由清华00后创办,团队超百人。已实现单月量产百台,订单破亿,推出具身操作基础模型,融资将用于软件、硬件和生态建设。
突发|Andrej Karpathy官宣加入Anthropic!
周二晚间,Andrej Karpathy在X上自宣加入Anthropic,将在核心预训练团队工作。他是AI领域极具影响力人物,曾任职OpenAI、特斯拉等。此次加入或助推Anthropic上市,也让OpenAI面临压力,或引发新一轮AI军备竞赛。
“我可能不再建议学计算机”!图灵奖得主炮轰半个行业,并断言:AI Agent最后全是数据库问题
图灵奖得主 Mike Stonebraker 在访谈中炮轰数据库行业,直言计算机科学未来或不再是增长型行业。他批判 Oracle、Google、AWS 等公司的数据库方案,还指出大模型写 SQL 在真实数据仓库中准确率极低,agentic AI 未来将成数据库问题。
Anthropic 研究员:强化学习将推动 Transformer 实现 AGI
在 AI Agenda Live 纽约活动上,Anthropic 强化学习团队技术负责人 Sholto Douglas 称,无需新架构突破,强化学习能让 Transformer 达人类专家级别表现,接近 AGI。但定义「好表现」是难题,Anthropic 或投 10 亿美元提升模型企业应用表现。
谷歌开源结构化信息提取神器!4K+ Star,精准定位+交互式可视化!
在医疗、法律等领域,手动从非结构化文本提取信息费力,传统NLP工具需复杂训练。谷歌开源的LangExtract是高精度信息抽取Python库,能自动提取结构化信息,有精确源定位等功能,还给出使用示例和典型场景。
在这场大会上,我们看到了AI进入物理世界后的样子|甲子光年
第七届北京智源大会亮点多,有四位图灵奖得主。议题紧跟前沿,设20个论坛和180余场报告。现场展示多个机器人应用。智源发布“悟界”系列大模型,还聚焦开源,升级FlagOS系统。两位图灵奖得主对AI安全看法不一。