科学创新」共找到 1162 篇相关文章

算法论文8

从少样本到千样本!MachineLearningLM给大模型上下文学习装上「机器学习引擎」

新研究 MachineLearningLM 提出轻量可移植「继续预训练」框架,突破 LLM 在上下文学习局限,能学上千示例,在多领域分类任务超基准模型。它有三项核心创新,效果惊艳且应用潜力大,还指明未来研究方向。

机器之心
新闻资讯7

张一甲:2025中国科技投资痛点、趋势与展望 | 甲子光年

8月21日,甲子光年创始人张一甲发布《2025中国科技投资:痛点、趋势与展望》报告。指出当前一级市场科技投资止跌回暖但堵点仍存,还阐述了硬科技引领、AI投资逻辑变化等七大趋势,最后用“星空坐标系”评估投资赛道。

甲子光年
新闻资讯7

首钢园变身机器人大世界

近日在北京首钢园举办的机器人产业生态峰会暨投资人大会上,超50家机器人企业携创新产品亮相,展示了机器人在工业、医疗、服务等多场景的实际应用,如宇树科技四足机器人用于电力巡检等。

首钢园
推荐文章7

深度学习中Batch Size对训练过程如何影响?

文章分析深度学习中batch size对训练过程的影响,探讨超大batch优缺点及应对方法。用面试、通俗、科学三种方式解答问题,还通过MNIST实验,从迭代速度、梯度平滑程度、收敛速度等指标对比不同batch size情况。

海边的拾遗者
新闻资讯8

火山引擎发布豆包大模型1.6,加速Agent大规模应用

6月11日,火山引擎举办Force原动力大会,发布豆包大模型1.6、视频生成模型Seedance 1.0 pro等,升级Agent开发平台。豆包1.6表现优异,应用广泛;Seedance 1.0 pro评测领先。还通过创新定价等推动Agent规模化应用。

AIGC开放社区
算法论文8

LoRA中到底有多少参数冗余?新研究:砍掉95%都能保持高性能

这篇创新研究介绍了LoRI技术,证明即使大幅减少LoRA的可训练参数,模型性能依然强劲。研究团队在多个任务上测试了LoRI,发现仅训练LoRA参数的5%,LoRI就能匹配或超越其他方法的性能。

机器之心
产品应用9

深度解读 DeepSeek V4.1 Flash 全新架构,如何成为显存杀手

本文深度解读DeepSeek最新发布的V4.1 Flash大模型,详解其全新CED架构与第二代压缩稀疏注意力CSA2,揭秘其通过架构创新大幅压缩KV缓存、降低显存算力成本,在长上下文Agent场景实现性能反超的细节。

AI科技评论
推荐文章7

清华东门1公里:AI原点社区的10万补贴和一天1块钱的工位

文章介绍北京AI原点社区,它2026年1月入选北京首批人工智能创新街区。这里无物理边界,三区融合,核心区16万平。企业可通过原点学堂等入驻,有补贴等资源。个人不挂靠公司也能用其资源,并给出使用建议。

AI Reading Hub
新闻资讯7

Claude还是最强,但Anthropic这周好像疯了

Anthropic状告阿里蒸馏模型致其股价创新低。一位87年创业者用AI搭工作流,起初用DeepSeek和Qwen问题多,换Claude后流程顺畅。MRCR v2测试显示国产模型与Claude有差距,便宜与省心模型该怎么选成问题。

探索AGI
开源动态8

刚刚,DeepSeek多模态技术范式公布,以视觉原语思考

DeepSeek发布多模态模型并公布技术报告,提出‘以视觉原语思考’。该模型解决多模态大模型‘指代鸿沟’问题,有把坐标变思维单元、7056倍视觉压缩、精心设计冷启动数据等创新,实验在多任务上超主流模型。

机器之心