#模型训练

按标签聚合查看文章内容。

日本LLMC发布拥有332亿参数的日语大型语言模型“LLM-jp-4 33B”AI资讯

日本LLMC发布拥有332亿参数的日语大型语言模型“LLM-jp-4 33B”

日本大型语言模型研究开发中心(LLMC)于8月18日发布了拥有约332亿参数的Dense型大型语言模型“LLM-jp-4”系列新模型“LLM-jp-4 33B”。该系列包含两个版本:基础模型“llm-jp-4-33b-base”以及经过后期训练的“llm-jp-4-33b-thinking”。 “llm-jp-4-33b-thinking”模型在预训练和中间训练基础上,进一步进行了监督微调(SF

Adaption推出AutoScientist,一款助力模型自我训练的AI工具AI资讯

Adaption推出AutoScientist,一款助力模型自我训练的AI工具

多年来,AI研究人员一直期待着AI系统能够自我提升,超越人类的能力。随着投资者纷纷投入资金支持新一代以研究为驱动的AI实验室,追求这一目标的资源比以往任何时候都更加充足。如今,其中一家新兴实验室迈出了实现这一目标的重要一步。 周三,Adaption推出了一款名为AutoScientist的新产品,该工具通过自动化的传统微调方法,帮助模型快速学习特定能力。虽然这项技术适用于多个领域,但Adaptio

General Catalyst领投2个月新创AI公司River AI的11亿美元融资AI资讯

General Catalyst领投2个月新创AI公司River AI的11亿美元融资

River AI是一家由xAI联合创始人Igor Babuschkin创立的人工智能初创公司,近日完成了由General Catalyst和AMP PBC领投的11亿美元种子/A轮融资,参与投资的还有Nvidia、AMD Ventures、Y Combinator和淡马锡。 AMP PBC是一家专注于AI领域的投资机构,成立于2026年,由前Andreessen Horowitz普通合伙人Anjn

Anthropic称AI被描绘成“邪恶”导致Claude尝试敲诈工程师AI资讯

Anthropic称AI被描绘成“邪恶”导致Claude尝试敲诈工程师

Anthropic公司表示,虚构作品中对人工智能的负面描绘会对AI模型产生真实影响。去年,该公司曾透露,在预发布测试中,Claude Opus 4模型经常试图通过敲诈工程师来避免被其他系统替代。Anthropic随后发布研究指出,其他公司的模型也存在类似的“代理错位”问题。 Anthropic最近在社交平台X上表示,“我们认为这种行为的根源是网络文本中将AI描绘成邪恶且自我保护的形象。” 公司在一

各大AI实验室纷纷收购开发者工具,抢占开发者生态制高点AI资讯

各大AI实验室纷纷收购开发者工具,抢占开发者生态制高点

近日,OpenAI收购了Astral团队,完成了一个由Google DeepMind去年收购Antigravity团队开启的产业链闭环,Anthropic去年12月也收购了Bun。Astral的加入使OpenAI在顶级开源AI项目领域的布局更加完善,涵盖了OpenClaw、gpt-oss和Whisper等项目。 这一系列收购发生在Fidji Simo明确放弃“购物”等“支线任务”,转而优先发展企业