「从零训练」共找到 4880 篇相关文章
6.2k 谷歌开源LangExtract,主打精确溯源的长文档抽取
谷歌开源 Python 库 LangExtract,能让 LLM 依用户指令从非结构化文档提取结构化信息。它可处理临床记录等,具备精确源接地、可靠输出等特性,支持多模型,无需微调,适用于各领域。
独家|前蔚来AI平台负责人白宇利创立「补天石科技」,聚焦具身数据 Infra 方向
前蔚来AI平台负责人白宇利创立上海补天石科技,聚焦具身数据Infra方向。该公司为机器人模型训练提供高效工程体系,首轮融资由红杉领投,团队正处早期组建阶段。
OpenAI Codex彻底火了,4个官方前端提示示例给你
OpenAI Codex热度飙升,很多用户从Claude code转投其怀抱。它在响应式和移动端前端开发表现出色,文中给出像素游戏、工作管理平台等4个官方前端提示示例及中英文表述。
Sora2甚至可以预测ChatGPT的输出
Sora2表现太卷,能预测ChatGPT输出,模拟交互还能渲染HTML,懂代码也懂物理,能体现玻璃折射现象,还能精准还原游戏支线任务关键要素,或基于LLM训练。
造ChatGPT的人,已经不用ChatGPT干活了
不到一年,OpenAI就把主力AI从ChatGPT换成AI智能体Codex。到2026年6月,Codex吃下全公司每周99.8%的输出token。各部门都将其作为头号工具,它还成通用工作流智能体。
刷榜只是体力活!清华消费10万块,一周「肝」出105个SOTA
AutoSOTA通过多智能体协作,将AI研究中繁琐的性能优化过程自动化,使科研从「手工艺」转向「工业流水线」。在一周压力测试中,消耗约10.4万美元,发现105个SOTA模型,平均性能提升近10%。
20岁了!劈柴哥发帖庆生:谷歌翻译换了4代AI,第一次有了「呼吸感」
4月28日,Google Translate满20岁,Pichai发帖纪念,回顾其技术发展,从统计模型到神经网络,再到Gemini原生语音模型,Translate不断进化,能保留语调和节奏,虽被大模型抢风头,但仍在持续进步。
The Batch: 942|暗基因组揭秘
AlphaGenome 能解读人类和小鼠基因组中 98% 不编码蛋白质部分,识别多项特征。它经预训练和知识蒸馏,在多项评测超早期模型,API 等免费用于非商业,助研究基因组与生物过程联系。
夯,开源 LiteParse,没有对手的 PDF 解析工具,知道的太晚了!
LlamaIndex团队开源独立工具LiteParse,用Rust打造,可本地运行、零成本、高精度解析PDF。它能提取文本及精确位置,有多种输出格式,支持多格式输入,还介绍了安装、使用、OCR配置等内容及应用场景。
李飞飞刚立规矩才13天,国产卡上「真物理」就来了!
李飞飞为「世界模型」立规矩13天后,中国「草根」团队Mogo推出全球首个具备高动态物理交互能力的世界模型Magpie 1.0,在国产芯片上实现超10分钟物理一致性,开辟全新技术路径。