大约有3项符合查询结果,库内数据总量为719,626项。(搜索耗时:0.0280秒) [XML]

1. 阿里云& NVIDIA TensorRT Hackathon 2023 决赛圆满收官 [100%]

...进和优化的结果。通过让更多模型能够顺利通过 ONNX自动解析得到加速,并对常见模型结构进行深度优化,极大地提高了 TensorRT的可用性和性能。这意味着大部分模型无需经过繁琐的手工优化,就能够在 TensorRT上有出色的性能表现。 TensorRT-LLM是NVIDIA即将推出用于大语言模型推理的工具,目前已于官网开放试用。作为此次复赛推荐使用的开发工具之一,TensorRT-LLM包含TensorRT深度学习...

标签: 发布日期:2023-10-18 05:03:54 Catid:1940 Status:6

2. 两成开发者月薪超1.7万 算法工程师最紧缺 [100%]

...两年是热点;人工智能技术日益受到企业和市场的关注,但64%企业尚未实现智能化,机器学习/深度学习算法工程师最为急缺;近七成开发者认为未来5G网络的传输速率能达到4G网络的10倍以上;Apache项目和Linux是开发者较为喜欢的开源项目;半数开发者很少参与开源项目的开发、维护、运营和社区发展等。

标签: 发布日期:2020-03-04 07:49:16 Catid:1164 Status:6

3. 47M参数打赢7B:语音判停模型TurnSense开源 [93%]

...高——特别是车载、开放办公、户外等场景。 行业开始转向模型判停——用深度学习模型判断用户是否说完。但现有方案存在一个三角困境:精度、成本、速度,最多满足两个。 7B参数的方案精度不错、延迟也低,但需要GPU,部署成本高。850M参数的方案精度好,但推理延迟接近200ms,同样需要GPU。8M参数的轻量方案能跑在CPU上,但F1只有70%出...

标签: 发布日期:2026-05-13 11:57:57 Catid:1940 Status:6