admin

帅气的我简直无法用语言描述!
AngelSpec – 腾讯混元团队开源的端到端推测解码训练框架

AngelSpec – 腾讯混元团队开源的端到端推测解码训练框架

AngelSpec是什么 AngelSpec 是腾讯混元团队开源的端到端推测解码训练框架,基于 TorchSpec 构建,支持 MTP 自回归与 DFly 块并行共 6 种草稿架构。推理与训练解耦,推...
2周前
030
Cosmos 3 Edge – 英伟达开源的 4B 参数世界模型

Cosmos 3 Edge – 英伟达开源的 4B 参数世界模型

Cosmos 3 Edge是什么 Cosmos 3 Edge 是 NVIDIA 推出的 4B 参数开源世界模型,专为机器人和边缘 AI 实时推理设计。模型基于 Nemotron 架构,融合自回归与扩散...
2周前
050
Grok Voice Think Fast 2.0 – SpaceXAI 推出的语音模型

Grok Voice Think Fast 2.0 – SpaceXAI 推出的语音模型

Grok Voice Think Fast 2.0是什么 Grok Voice Think Fast 2.0 是 SpaceXAI(xAI)推出的端到端语音到语音模型,采用原生语音到语音架构,无需经过...
2周前
020
商汤 Seko 3.0 实测 – 一键生成爆款AI短漫剧 

商汤 Seko 3.0 实测 – 一键生成爆款AI短漫剧 

AI 剧漫剧的观众越来越多,普通创作者却越来越难赚到钱了。 这并不是你的错觉,DataEye 预估显示,2025 年国内漫剧用户规模约 1.2 亿,到 2026 年上半年,用户规模已突破 6 亿,规模...
2周前
020
BigMac – 小红书开源的多模态大模型流水并行训练框架

BigMac – 小红书开源的多模态大模型流水并行训练框架

BigMac是什么 BigMac 是小红书 dots infra 团队开源的多模态大模型流水并行训练框架,针对 MLLM 训练中计算效率与显存占用难以兼顾的问题,提出依赖安全的嵌套流水线范式。框架用成...
2周前
030
MiniMax H3 – 稀宇科技推出的通用全模态生成模型

MiniMax H3 – 稀宇科技推出的通用全模态生成模型

MiniMax H3是什么 MiniMax H3 是稀宇科技推出的通用全模态生成模型,打破传统任务与模态边界,支持对文本、图像、视频、音频的统一理解与原生生成。模型能输出原生双声道音视频,最高支持15...
2周前
0590
Ling 3.0 Flash – 蚂蚁百灵推出的轻量级 MoE 推理模型

Ling 3.0 Flash – 蚂蚁百灵推出的轻量级 MoE 推理模型

Ling 3.0 Flash是什么 Ling-3.0-Flash 是蚂蚁集团百灵大模型推出的轻量级 MoE 推理模型,总参数量 124B、每 token 激活 5.1B 参数,支持 256K 超长上下...
2周前
050
怎么把 Codex 的模型接入 Claude Code ?附完整教程

怎么把 Codex 的模型接入 Claude Code ?附完整教程

最近 Claude 又开始大面积封号,我的主号终究也没能幸免。 账号被封是小,但在 Claude Code 里面有很多的记忆、定时任务,又不能停用… 刷到 OpenAI 的核心产品负责人 Tibo 分...
2周前
010
MAI-Voice-2-Flash – 微软推出的高速语音合成模型

MAI-Voice-2-Flash – 微软推出的高速语音合成模型

MAI-Voice-2-Flash是什么 MAI-Voice-2-Flash 是微软AI团队推出的高速语音合成模型。模型专为高并发、低延迟语音场景优化,相比前代MAI-Voice-2速度提升约2倍,成...
2周前
010
Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型

Qwen-Audio-3.0-ASR-Flash – 阿里千问推出的语音识别大模型

Qwen-Audio-3.0-ASR-Flash是什么 Qwen-Audio-3.0-ASR-Flash 是阿里千问团队推出的语音识别大模型,现已通过阿里云百炼平台开放调用,提供 Flash、File...
2周前
0180