「无训练框架」共找到 3936 篇相关文章
阿里云通义点金发布DianJin-R1金融领域推理大模型,32B模型荣膺榜首
阿里云通义点金团队与苏州大学合作推出DianJin-R1金融领域推理大模型,介绍其开源数据集与模型、基于通义点金平台的数据合成,展示了其在性能测试中的优异表现,推动金融科技智能化进程。
来吧,往死理卷,9.8K Star TypeWords~~~
本文推荐Star量9.8K的开源背词项目TypeWords,针对「眼熟单词写不出」的痛点,设计了无提示输出的练习闭环,面向技术人给出使用指南,同时说明其本地存储特性与同步限制。
刚刚,中国AI天团杀向RSI!1分钟预测全球天气、20分钟手搓OS
本文报道上海人工智能实验室等多家机构联合发布智能体模型Atria Dawn Preview,该模型可1分钟预测全球天气、20分钟搭建MiniOS,团队同时分析AI研发中的人机分工,披露最新协作数据。
27岁研究员连辞OpenAI、Anthropic!两家都在拿我们的命下注
本文报道GPT-4o核心贡献者Jacob Coxon接连从OpenAI、Anthropic辞职并退出AI行业,批判头部AI机构陷入竞速赛,罔顾超级智能失控风险,直指行业需共同踩刹车。
陈大年复出,入局大模型
国产大模型领域黑马StartLux-V1.0-27B-Preview,参数量仅27B,在信通院MCP测试中排综合第二,仅次于1.6万亿参数量的DeepSeek-V4-Pro。其创始人陈大年押注本地模型,公司专注该领域商业化。
给Agent加上知识图谱,开源版Palantir
Semantica是LLM、向量库与Agent框架下的语义/上下文层,能把碎片化企业数据变成结构化、可查询的上下文图与知识图谱。介绍了其面向对象、功能、优势、使用方法、架构等内容。
坚决不用行业标准AGENTS.md,Claude Code惹来“封杀令”:Anthropic终于回应了,但开发者更气了
当所有AI编程工具向行业标准靠拢时,Anthropic的Claude Code拒绝支持AGENTS.md格式,引发Shopify CEO公开威胁。开发者多次要求其支持该格式无果,Anthropic回应未让开发者满意,引发争议升级。
这 5 个 DeepSeek 开源项目,最近夯爆了!
几天前,DeepSeek发布开源智能体框架`DeepSeek Harness`,热度极高。围绕它社区长出丰富高星项目,本文整理了5个,如核心项目`DeepSeek Harness`、桌面客户端、Web UI插件、终端交互插件及插件导航手册。
长程执行成具身智能必考题,墨奇的答案是Agentic-Native|甲子光年
具身智能中长程执行成关键问题,墨奇智能发布具身模型架构MoRA,提出Agentic - Native技术路线,让Agentic能力原生存在于策略模型中,还介绍了模型内部设计、所需数据等内容。
Coding Agent 自主解题很强,但用户改一行代码就"翻车"?自所团队提出 SWE-Touch 揭示共享工作空间下的能力缺口
当前基于大模型的Coding Agent是热门研究方向,现有评测多假设其独占代码仓库。中科院自动化所团队构建SWE - Touch框架,对9个前沿模型测试,发现用户干预下模型性能下降、排名洗牌。