「AI 研究」共找到 10672 篇相关文章

新闻资讯7

澜起科技:高速互连芯片巨头历史

文章讲述澜起科技发展历程。它从电视机顶盒芯片转型内存接口、高速互连芯片,虽历经政策冲击、做空危机、供应链压力与客户竞争等挑战,但凭借技术实力和研发投入,在行业中站稳脚跟,未来有望受益于AI算力需求升级。

芯师爷
7

刚刚,「吉卜力狂欢」GPT-4o功臣被挖走!华南理工女学霸曾与奥特曼同台

GPT-4o引爆全球「吉卜力风格」风潮后,其核心成员华南理工学霸Lu Liu与伯克利博士Allan Jabri跳槽Meta。此前他们在OpenAI主导多模态AI研究,与奥特曼同台展示关键功能,此次挖角凸显OpenAI人才流失危机。

新智元
新闻资讯9

Claude独立攻克理论物理前沿难题,全程无人指导,花费不到两千美元

本文报道Anthropic旗下大模型Claude在几乎无人指导的情况下,独立完成理论物理前沿难题——平面N=4超杨-米尔斯理论九圈六胶子散射振幅计算,总成本不到两千美元,中科院团队也借助GPT-6得到结果,业内探讨了AI在科研中的能力边界。

DeepTech深科技
新闻资讯7

存储芯片领域又冲出一家IPO!年入37亿

AI驱动存储“超级周期”,行业巨头提价,国内存储芯片公司股价上涨。深圳晶存科技9月底递表港交所,此前募资超7.06亿,2024年末投后估值37亿。虽净利润为正,但经营现金流持续为负,全球嵌入式存储市场市占率约1.6%。

芯师爷
开源动态7

智谱新模型也用DeepSeek的MLA,苹果M5就能跑

智谱AI上市后发布新成果,开源轻量级大语言模型GLM-4.7-Flash,API免费开放调用。该模型是30B总参数、3B激活参数的MoE架构,定位为“本地编程与智能体助手”,评测表现佳,采用MLA架构,多平台支持。

量子位
推荐文章8

Thinking Machines又发高质量博客:力推LoRA,不输全量微调

Thinking Machines 博客力推 LoRA 并与全量微调对比。研究发现小数据量任务中 LoRA 与全量微调效果接近,大数据量稍吃力,强化学习中低秩 LoRA 也能接近全量微调。还揭示了 LoRA 关键要素、超参数规律等。

机器之心
开源动态7

非Transformer架构的新突破,液态神经网络的推理小模型只用900M内存

谷歌提出的Transformer架构基本垄断大模型,而初创公司Liquid AI研发的液态神经网络架构另辟蹊径。其发布并开源的LFM2.5 - 1.2B - Thinking模型,仅需900MB内存就能在端侧运行,性能优于Transformer架构模型,还降低了死循环生成比例。

机器之心
产品应用7

回归C++: 在GGUF上构建高效的向量模型

Jina AI分享将纯解码器向量模型适配到GGUF格式及在llama.cpp工具链的优化经验。经处理得到特定任务v4模型,还生成量化版本并上传。介绍使用方法、注意事项,经测试推荐IQ3_S或IQ3_M版配合定制工具。

Jina AI
新闻资讯8

Karpathy 回应争议:RL 不是真的不行,Agent 还需要十年的预测其实很乐观

Andrej Karpathy 在与知名播客主持人 Dwarkesh Patel 的对谈中指出当下 LLMs 研究进展、Agents 存在的实际问题,如‘AGI 仍需十年时间’‘LLM 认知有缺陷’‘强化学习很糟糕’等。他还对关键争议点做了补充回应,包括对 AGI 时间线、强化学习局限性等的看法。

Founder Park
7

生财有术小连:微信问一问蓝海机会,用搜索玩法抢占流量先机

生财有术小连分享微信问一问运营经验,指出其支持真人分享、有“去AI化”特点及“强SEO搜索、排名”机制。介绍视觉霸占、抢词根等玩法,还给出内容与ID绑定等运营建议,称当前是SEO玩法的蓝海时期。

白杨SEO优化教程