IBM发布了Granite 4.2系列开源语言模型,包含3B、8B和30B三种参数规模,均采用Apache 2.0许可证。这些模型从零训练,使用了约15万亿个token,支持高达512,000 token的上下文窗口,并可在“思考”和“非思考”模式间切换以控制计算资源消耗。8B和30B版本经过“智能体强化学习”训练,能在真实沙盒环境中学习使用工具、编写运行代码和搜索网页,并支持OpenAI格式的工具调用。此外,IBM还推出了Granite Speech 5.0 Turbo语音模型,仅4.7亿参数,转录速度比此前领先模型快两倍,每秒可处理三小时音频。所有模型已在Hugging Face、Ollama和GitHub等平台开放下载。这一发布体现了IBM在开源AI领域的持续投入,强化了其模型在智能体任务和语音处理方面的竞争力。
📱 每天一份 AI 前沿日报
关注公众号,每天 09:00 推送 · 不错过任何重磅