等变建模」共找到 8436 篇相关文章

开源动态7

从一行代码发现DeepSeek的秘密:Model1到底是什么?

在DeepSeek - R1发布一周年时,有人在GitHub的FlashMLA代码仓库发现神秘代号Model1,可能是V4。文章分析了代码仓库用途、新模型“露馅”原因,还从代码中发现Model1细节,结合论文梳理时间线,最后也提出了怀疑。

花叔
新闻资讯8

Andy Pavlo:2025年数据库年度回顾

Andy Pavlo回顾2025年数据库领域,提及PostgreSQL发展、MCP支持情况、MongoDB起诉案、文件格式竞争。还介绍收购、合并、融资动态,以及数据库元老拉里·埃里森的成就,最后给出建议并提及新创业公司。

InfoQ
新闻资讯7

刚刚,智谱正式成“全球大模型第一股”,开盘涨超3%!10位董事7个清华背景,专家:国内IPO抢收“确定性”,OpenAI们豪赌“无限性”

今天,智谱在港交所正式挂牌上市,成“全球大模型第一股”。其有技术、产品、商业化竞争力,但未盈利,研发投入大。专家认为国内大模型厂商上市是抢收确定性,而OpenAI是扩展无限性。

InfoQ
新闻资讯8

Anthropic重磅新研究:当AI采访了1250人,它看见了人类的「职业软肋」

Anthropic推出Interviewer工具,与1250名职场人、创作者、科学家深度对话,记录细节并量化。该工具能自动完成访谈、分析流程,受访者满意度超97%。研究揭示不同职业对AI态度受职业结构因素影响。

新智元
推荐文章8

2025 年最全面的 LLM 架构技术解析【长文】

Sebastian Raschka更新「大型LLM架构对比」长文,解析2025年LLM架构发展。介绍了如DeepSeek V3、OLMo 2、Gemma 3模型架构特点,像DeepSeek V3用MLA和MoE提升效率,还探讨线性注意力复兴趋势。

AGI Hunt
新闻资讯7

一篇文章告诉你:国产 GPU 背后的技术和商业路线异同

过去两年,国产 GPU 赛道进入公开财务与审视阶段。文章分析了摩尔线程、沐曦企业不同技术与商业路线,如摩尔线程走“高启动+快扩张”,沐曦选“厚积薄发+先服务高端算力场景”

芯师爷
新闻资讯8

1.8亿个岗位数据分析揭秘,AI究竟取代了什么工作

Revealera联合创始人Henley Wing Chiu研究近1.8亿份全球岗位数据,发现2025年全球招聘岗位总量降8%。创意执行、监管环境岗位跌幅大,AI相关、高层领导岗位增长或表现坚韧,AI影响有选择性。

AIGC开放社区
算法论文8

邱锡鹏团队新作:让机器人学会「察言观色」

复旦大学邱锡鹏团队发布全新操作框架 RoboOmni,突破传统 VLA 依赖显式指令局限。它融合多模态信号,构建数据集,在成功率方面超基线,以跨模态指令让机器人主动推断意图,开启具身智能‘共情时代’。

AI科技评论
8

AI 巨头对话:Sam Altman 与 Satya Nadella 论 AI 未来、算力与微软王牌

OpenAI的Sam Altman和微软的Satya Nadella在播客中探讨AI未来话题。涉及1.4万亿算力投入、微软与OpenAI新合作协议细节,指出瓶颈在数据中心和电力,还谈及AI经济模型、未来愿景

宝玉AI
产品应用8

锁死一致性!Vidu Q2「参考生」可算来了,新功能强到离谱,APP全面进化

生数科技Vidu Q2「参考生」功能全球正式上线,APP端全面改版。新上线「视频延长」功能,最长扩展5分钟,还在一致性、速度、成本方面优化,在镜头语言、语义理解表现出色,APP社交体验好。

新智元