返回首页
MiniMax M3
找到 3 篇关于此标签的文章
DeepSeekDeepSeek v4 Pro
1.6 万亿参数没换来头部成绩,DeepSeek v4 Pro 的看点已不只在模型本身
DeepSeek v4 Pro 以 1.6 万亿参数进入开源大模型第一梯队,但讨论焦点并不在“是否最强”,而在“为何这么大却只跑出中上成绩”。这件事值得关心,因为大模型竞争正从参数和榜单,转向推理成本、硬件适配与商业可用性。
Jun 132 分钟
MiniMaxMiniMax M3
MiniMax M3 因兼容性退回密集注意力,开源热度高但本地部署还不成熟
MiniMax M3 的社区版本近期被发现因暂不支持稀疏注意力而“退回密集注意力”,这意味着推理时计算成本明显上升。值得关心的是,大模型参数做得更大不等于普通人就能更方便地用上,部署生态反而成了下一道门槛。
Jun 132 分钟
MiniMaxMiniMax M3
MiniMax M3 被指几乎不设政治审查,这对中国大模型是个危险信号
一则来自开发者社区的测试称,MiniMax M3 在政治敏感话题上明显比同类中国模型更少设限。消息本身还未经官方确认,但它值得关心,因为这不是单纯的“能不能答”,而是中国大模型公司在出海、合规和产品边界之间如何取舍的问题。
Jun 22 分钟