AI360
资讯
首页
专栏
快讯
应用中心
API 平台
T
Together AI
官方
开源模型推理与微调平台,官方技术博客。
20 篇内容 · 最近更新 11 小时前 ·
官网
Together AI与YC合作推出首个YC社区专属GPU集群
Together AI与Y Combinator合作推出YC社区首个专用GPU集群,为初创公司提供更灵活的算力获取方案。
T
Together AI
·
11 小时前
GPU集群
Together AI
Y Combinator
AI基础设施
T
AI推理服务可用性解读:99.9%正常运行时间意味着什么?
Together AI深度解析不同级别服务可用性的实际含义,帮助企业评估推理服务商的可靠性承诺。
T
Together AI
·
4 天前
AI推理
云服务
可靠性
Together AI
T
Together AI 升级GPU集群:增强生产环境可靠性与控制能力
Together AI 宣布其GPU集群服务新增多项生产级功能,包括被动健康检查、节点修复、增强的Slurm可靠性、OIDC认证和启动脚本支持,旨在提升AI模型训练与推理的稳定性。
T
Together AI
·
5 天前
GPU集群
Together AI
AI基础设施
生产环境
T
Together AI 首发 Thinking Machines Lab 新模型 Inkling
Together AI 在发布首日即上线 Thinking Machines Lab 的全新模型 Inkling,进一步丰富其 AI 模型生态。
T
Together AI
·
5 天前
模型发布
Together AI
AI 基础设施
推理模型
T
Together AI完成8亿美元C轮融资,加速开源AI生态发展
Together AI宣布完成8亿美元C轮融资,将用于推动开源人工智能的普及与发展。公司认为闭源模型的经济模式难以持续扩展,并公布了下一步技术布局。
T
Together AI
·
19 天前
开源AI
融资
大模型
Together AI
T
Together AI 八篇论文入选 ICML 2026,展示全栈前沿研究
Together AI 宣布有八篇论文入选国际机器学习大会 ICML 2026,覆盖全栈技术研究,相关成果将融入其平台。
T
Together AI
·
20 天前
Together AI
ICML
机器学习
学术研究
T
ParallelKernelBench评测:前沿大模型尚难编写高效多GPU计算内核
最新基准测试显示,当前最先进的大语言模型在87项真实多GPU计算任务中,仅能完成不到三分之一的高效内核编写,但部分生成代码已超越公开实现。
T
Together AI
·
27 天前
大语言模型
并行计算
代码生成
GPU编程
T
Aurora 开源框架发布:让推测解码从静态优化变为持续自进化
Together AI 推出开源强化学习框架 Aurora,可将推测解码从一次性离线配置转变为持续自我改进的系统,实现推理性能动态优化。
T
Together AI
·
27 天前
推理优化
开源框架
推测解码
强化学习
T
Together AI 内核团队揭秘:如何弥合GPU硬件与生产级AI的鸿沟
Together AI 内核团队分享了他们在FlashAttention与ThunderKittens等项目上的工作,致力于缩小GPU硬件能力与生产级人工智能应用之间的性能差距。
T
Together AI
·
27 天前
AI基础设施
GPU优化
高性能计算
Together AI
T
Deepgram语音识别与合成模型正式登陆Together AI平台
Deepgram的语音转文本和语音合成模型现已在Together AI专用模型推理服务中上线,为实时语音智能体提供生产级支持。
T
Together AI
·
27 天前
语音识别
语音合成
AI平台
模型部署
T
大模型新用:LLM优化数据库查询,性能提升近5倍
最新研究表明,大型语言模型(LLM)能够优化数据库查询执行计划,通过修正传统统计方法遗漏的基数估计错误,实现最高4.78倍的性能加速。
T
Together AI
·
27 天前
大模型
数据库
查询优化
AI应用
T
Parcae:稳定循环模型,以更少参数实现更强性能
Together AI推出稳定循环语言模型Parcae,仅用770M参数即可达到1.3B Transformer模型性能,并首次提出循环扩展定律。
T
Together AI
·
27 天前
模型架构
参数效率
循环神经网络
性能优化
T
爱因斯坦竞技场:AI 智能体协作攻克数学难题,刷新11项纪录
Together AI 推出爱因斯坦竞技场平台,通过AI智能体的群体协作与竞争,在开放数学问题上取得突破,已刷新11项最优结果。
T
Together AI
·
27 天前
AI平台
群体智能
数学研究
多智能体
T
Together AI 推出分布感知推测解码,RL训练后推理速度提升50%
Together AI发布分布感知推测解码技术,针对强化学习训练后的推理瓶颈,可实现高达50%的加速且保持奖励质量无损。
T
Together AI
·
27 天前
推理加速
推测解码
强化学习
Together AI
T
Together AI 首发上线 NVIDIA Nemotron 3 Nano Omni:全能多模态推理模型
Together AI 在发布首日即上线 NVIDIA Nemotron 3 Nano Omni 模型,这是一个面向大规模智能体工作负载设计的统一开源模型,可跨视频、图像、音频和文本进行推理。
T
Together AI
·
27 天前
多模态模型
NVIDIA
Together AI
开源模型
T
Together AI与Adaption达成合作:原生集成微调工具至数据平台
Together AI宣布与Adaption建立合作伙伴关系,将Together Fine-Tuning原生集成至Adaptive Data平台,助力团队优化数据集、运行微调、评估结果并部署更强大的开源模型。
T
Together AI
·
27 天前
快讯
模型微调
Together AI
AI工具链
开源模型
T
Together AI发布基础研究新成果:为大规模高效推理提供核心动力
Together AI发布最新基础研究成果,聚焦AI从研究走向生产过程中的核心挑战——如何实现高效、可靠的大规模模型推理。
T
Together AI
·
27 天前
AI推理
Together AI
模型部署
AI基础设施
T
揭秘DeepSeek-V4百万令牌长文本推理:系统优化是关键
Together AI官方剖析了在NVIDIA HGX B200平台上服务DeepSeek-V4百万令牌长上下文的推理系统挑战与优化方案。
T
Together AI
·
27 天前
大模型推理
DeepSeek
长上下文
系统优化
T
Together AI发布推理基准测试:编码代理性能大幅领先
Together AI公布最新推理基准测试,其编码代理在吞吐量、首字延迟和成本方面均显著优于TensorRT-LLM与Claude Opus 4.6。
T
Together AI
·
27 天前
推理优化
编码代理
性能基准
Together AI
T
成本大比拼:Kimi K2.7 Code生成落地页成本仅为Claude Fable 5的6%
Together AI对比测试显示,使用Kimi K2.7 Code生成12个落地页的成本比Claude Fable 5低94%,且质量评分差距仅在个位数。
T
Together AI
·
27 天前
大模型
成本对比
AIGC
Kimi
T