{"schema_version":"onlylabs.public_signal.v1","title":"Baseten Writing: How Baseten Makes Pyannotes Diarization Models 96x Faster","description":"Baseten writing signal with public source context, captured evidence pages, related signals, and category-scoped analysis context.","url":"https://onlylabs.fyi/signals/7b42fac2-f048-41b3-9275-349c47f2335a","json_url":"https://onlylabs.fyi/signals/7b42fac2-f048-41b3-9275-349c47f2335a/signal.json","generated_at":"2026-09-09T22:29:57.900Z","evidence_latest_fetched_at":"2026-09-09T20:02:27.405981+00:00","signal_first_seen_at":"2026-09-09T20:00:53.077479+00:00","org":{"slug":"baseten","name":"Baseten","category":"neocloud","category_label":"Neocloud","dossier_url":"https://onlylabs.fyi/labs/baseten","dossier_json_url":"https://onlylabs.fyi/labs/baseten/dossier.json"},"related_urls":{"signal":"https://onlylabs.fyi/signals/7b42fac2-f048-41b3-9275-349c47f2335a","signal_json":"https://onlylabs.fyi/signals/7b42fac2-f048-41b3-9275-349c47f2335a/signal.json","source":"https://www.baseten.co/blog/how-baseten-makes-pyannotes-diarization-models-96x-faster/","lab_dossier":"https://onlylabs.fyi/labs/baseten","lab_dossier_json":"https://onlylabs.fyi/labs/baseten/dossier.json","analysis":"https://onlylabs.fyi/analysis/baseten","analysis_json":"https://onlylabs.fyi/analysis/baseten/analysis.json","analysis_evidence_json":"https://onlylabs.fyi/analysis/baseten/evidence.json","category":"https://onlylabs.fyi/neoclouds","category_json":"https://onlylabs.fyi/neoclouds.json","category_feed":"https://onlylabs.fyi/neoclouds/feed.xml","category_signals_json":"https://onlylabs.fyi/signals.json?category=neocloud","topic":"https://onlylabs.fyi/topics/talking","topic_signals_json":"https://onlylabs.fyi/topics/talking/signals.json?category=neocloud","topic_feed":"https://onlylabs.fyi/topics/talking/feed.xml?category=neocloud","data_business":null},"answer_pack":{"answer":"Baseten published How Baseten Makes Pyannotes Diarization Models 96x Faster. This talking signal gives public context for research themes, product direction, policy, or launch framing. High-signal details: Substantive technical post on 96x faster diarization serving · How Baseten makes pyannote’s diarization models 9.6x faster Model performance How Baseten makes pyannote’s diarization models 9.6x faster Using quality-aware.... onlylabs links this event to 1 captured evidence page and 6 related writing signals.","signal_desk":"talking","source_context":{"source_url":"https://www.baseten.co/blog/how-baseten-makes-pyannotes-diarization-models-96x-faster/","source_host":"baseten.co","occurred_at":"2026-09-09T00:00:00+00:00","first_seen_at":"2026-09-09T20:00:53.077479+00:00","date_source":"sitemap.lastmod","context":null},"context_markers":[{"label":"Lab","value":"Baseten","source":"signal"},{"label":"Signal desk","value":"talking","source":"signal"},{"label":"Source host","value":"baseten.co","source":"source"},{"label":"Notability","value":"Substantive technical post on 96x faster diarization serving","source":"signal"},{"label":"Watch term","value":"Model card","source":"model"},{"label":"Watch term","value":"Data pipeline","source":"evidence"},{"label":"Watch term","value":"Infrastructure","source":"evidence"}],"evidence_coverage":{"target_pages":1,"captured_pages":1,"readable_pages":1,"capture_methods":["plain"],"missing_page_urls":[],"failed_page_urls":[],"blocked_page_urls":[],"page_urls":["https://www.baseten.co/blog/how-baseten-makes-pyannotes-diarization-models-96x-faster/"],"related_signals":6,"has_source_url":true,"latest_page_fetched_at":"2026-09-09T20:02:27.405981+00:00"},"data_business":{"matches":false,"lanes":[],"matched_terms":[],"score":null,"reason":null},"agent_handoff":{"signal_json":"https://onlylabs.fyi/signals/7b42fac2-f048-41b3-9275-349c47f2335a/signal.json","dossier_json":"https://onlylabs.fyi/labs/baseten/dossier.json","analysis_json":"https://onlylabs.fyi/analysis/baseten/analysis.json","analysis_evidence_json":"https://onlylabs.fyi/analysis/baseten/evidence.json","topic_signals_json":"https://onlylabs.fyi/topics/talking/signals.json?category=neocloud","topic_feed":"https://onlylabs.fyi/topics/talking/feed.xml?category=neocloud","category_signals_json":"https://onlylabs.fyi/signals.json?category=neocloud","data_radar_json":null,"opportunities_json":null},"analysis_playbook":{"objective":"Turn public writing and discussion into a readable map of research themes, product framing, policy posture, launch narratives, and market attention.","evidence_focus":["post title","source URL","captured page text","HN traction","linked model or paper references","publication date"],"extraction_questions":["Which themes are labs choosing to explain publicly?","Which posts are attracting outside discussion?","Which writing reframes a recent release, model, hiring wave, or policy stance?","Which posts mention data, evals, infrastructure, safety, or deployment workflows?"],"signal_questions":["What public theme, launch framing, or research direction does this writing signal expose?","Which themes are labs choosing to explain publicly?","Which posts are attracting outside discussion?","Do the 6 related writing signals show a repeated pattern?"],"output_fields":["org","theme","public_framing","traction","evidence_url"],"data_business_relevance":"Data-business lane extraction is scoped to frontier labs; for this category, keep conclusions tied to category-specific strategy, source evidence, and follow-up questions.","required_sources":[{"label":"signal_json","url":"https://onlylabs.fyi/signals/7b42fac2-f048-41b3-9275-349c47f2335a/signal.json","required":true},{"label":"source","url":"https://www.baseten.co/blog/how-baseten-makes-pyannotes-diarization-models-96x-faster/","required":true},{"label":"dossier_json","url":"https://onlylabs.fyi/labs/baseten/dossier.json","required":true},{"label":"analysis_evidence_json","url":"https://onlylabs.fyi/analysis/baseten/evidence.json","required":true},{"label":"topic_signals_json","url":"https://onlylabs.fyi/topics/talking/signals.json?category=neocloud","required":false},{"label":"data_radar_json","url":null,"required":false}],"expected_output":["one-paragraph source-grounded interpretation","category-specific implication","confidence and missing evidence","recommended next source to inspect"],"prompt_seed":"Using only the linked onlylabs JSON, captured source context, and cited evidence, analyze Baseten's writing signal \"How Baseten Makes Pyannotes Diarization Models 96x Faster\" for neocloud strategy."},"semantic_triples":[{"subject":"Baseten","predicate":"published","object":"How Baseten Makes Pyannotes Diarization Models 96x Faster","text":"Baseten published How Baseten Makes Pyannotes Diarization Models 96x Faster."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"is classified as","object":"writing signal","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster is classified as writing signal."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"belongs to","object":"talking desk","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster belongs to talking desk."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has evidence coverage","object":"1 captured evidence page","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has evidence coverage 1 captured evidence page."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has captured page count","object":"1","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has captured page count 1."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has readable page count","object":"1","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has readable page count 1."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has related signal count","object":"6","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has related signal count 6."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has analysis playbook objective","object":"Turn public writing and discussion into a readable map of research themes, product framing, policy posture, launch narratives, and market attention.","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has analysis playbook objective Turn public writing and discussion into a readable map of research themes, product framing, policy posture, launch narratives, and market attention.."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has source host","object":"baseten.co","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has source host baseten.co."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has lab","object":"Baseten","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has lab Baseten."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has signal desk","object":"talking","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has signal desk talking."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has source host","object":"baseten.co","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has source host baseten.co."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has notability","object":"Substantive technical post on 96x faster diarization serving","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has notability Substantive technical post on 96x faster diarization serving."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has watch term","object":"Model card","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has watch term Model card."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has watch term","object":"Data pipeline","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has watch term Data pipeline."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has watch term","object":"Infrastructure","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has watch term Infrastructure."}]},"intelligence":{"signal_desk":"talking","answer":"Baseten published How Baseten Makes Pyannotes Diarization Models 96x Faster. This talking signal gives public context for research themes, product direction, policy, or launch framing. High-signal details: Substantive technical post on 96x faster diarization serving · How Baseten makes pyannote’s diarization models 9.6x faster Model performance How Baseten makes pyannote’s diarization models 9.6x faster Using quality-aware.... onlylabs links this event to 1 captured evidence page and 6 related writing signals.","semantic_triples":[{"subject":"Baseten","predicate":"published","object":"How Baseten Makes Pyannotes Diarization Models 96x Faster","text":"Baseten published How Baseten Makes Pyannotes Diarization Models 96x Faster."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"is classified as","object":"writing signal","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster is classified as writing signal."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"belongs to","object":"talking desk","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster belongs to talking desk."},{"subject":"How Baseten Makes Pyannotes Diarization Models 96x Faster","predicate":"has evidence coverage","object":"1 captured evidence page","text":"How Baseten Makes Pyannotes Diarization Models 96x Faster has evidence coverage 1 captured evidence page."}]},"signal":{"id":"7b42fac2-f048-41b3-9275-349c47f2335a","url":"https://onlylabs.fyi/signals/7b42fac2-f048-41b3-9275-349c47f2335a","json_url":"https://onlylabs.fyi/signals/7b42fac2-f048-41b3-9275-349c47f2335a/signal.json","source_url":"https://www.baseten.co/blog/how-baseten-makes-pyannotes-diarization-models-96x-faster/","title":"How Baseten Makes Pyannotes Diarization Models 96x Faster","summary":"Baseten published a writing signal. onlylabs watches public writing for research themes, product direction, and model-launch context.","context":null,"kind":{"key":"post_published","label":"Writing"},"org":{"slug":"baseten","name":"Baseten","category":"neocloud"},"occurred_at":"2026-09-09T00:00:00+00:00","first_seen_at":"2026-09-09T20:00:53.077479+00:00","date_source":"sitemap.lastmod","evidence_coverage":{"target_pages":1,"captured_pages":1,"readable_pages":1,"capture_methods":["plain"],"missing_page_urls":[],"failed_page_urls":[],"blocked_page_urls":[],"page_urls":["https://www.baseten.co/blog/how-baseten-makes-pyannotes-diarization-models-96x-faster/"]},"facets":{},"traction":{"github_stars":null,"hn_points":null,"hn_comments":null,"hn_story_id":null,"hf_downloads":null,"hf_likes":null},"data_radar":null},"primary_evidence_page":{"is_primary":true,"source_match":true,"url":"https://www.baseten.co/blog/how-baseten-makes-pyannotes-diarization-models-96x-faster/","final_url":"https://www.baseten.co/blog/how-baseten-makes-pyannotes-diarization-models-96x-faster/","title":"How Baseten Makes Pyannotes Diarization Models 96x Faster","http_status":200,"content_type":"text/html; charset=utf-8","capture_method":"plain","fetched_at":"2026-09-09T20:02:27.405981+00:00","bytes":340918,"raw_path":"f8ace9f50c07c63afdeef3006aed1646dc3167c9e5cb3b90f634568344f62871.html","content_hash":"25743d3b3c12823206d80bb8a2599ffd629a466a157a0df45ca7c99b253b26d5","excerpt_chars":1200,"truncated":true,"excerpt":"How Baseten makes pyannote’s diarization models 9.6x faster Model performance How Baseten makes pyannote’s diarization models 9.6x faster Using quality-aware quantization, index-based clustering, and scheduling optimizations Authors Matte Lim Ansel Erol Last updated September 9, 2026 Share TL;DR Pyannote’s Community and Precision research models add state-of-the-art speaker attribution to your ASR workloads, but serving them efficiently required careful optimization. We combined quality-aware quantization, index-based clustering algorithms, and scheduling optimizations to reduce latency by up to 9.6x and increase throughput by 3x on long audio, unlocking rapid diarization at scale. Speaker diarization — figuring out who spoke when in an audio recording — is one of the harder problems in speech AI, and one of the most useful once it works: meeting notes, call-center analytics, podcast transcripts, and media archives all depend on knowing which voice said what. The problem is that high-quality models are typically slow and expensive to run, while affordable models are often not good enough for people building voice products. Additionally, running diarization in production workloads..."},"evidence_pages":[],"related_signals":[{"id":"5a040dc3-5085-482d-bb70-4e9096d0e574","url":"https://onlylabs.fyi/signals/5a040dc3-5085-482d-bb70-4e9096d0e574","source_url":"https://www.baseten.co/blog/optimizing-delta-weight-syncs-for-managed-rollouts/","title":"Optimizing Delta Weight Syncs For Managed Rollouts","context":null,"kind":{"key":"post_published","label":"Writing"},"org":{"slug":"baseten","name":"Baseten","category":"neocloud"},"occurred_at":"2026-09-08T22:36:24+00:00","first_seen_at":"2026-09-09T00:00:51.730848+00:00","date_source":"sitemap.lastmod"},{"id":"4bc6b810-0677-4409-a1bb-b8d733ecb37b","url":"https://onlylabs.fyi/signals/4bc6b810-0677-4409-a1bb-b8d733ecb37b","source_url":"https://www.baseten.co/blog/baseten-leads-covals-voice-ai-benchmark/","title":"Baseten Leads Covals Voice Ai Benchmark","context":null,"kind":{"key":"post_published","label":"Writing"},"org":{"slug":"baseten","name":"Baseten","category":"neocloud"},"occurred_at":"2026-09-08T22:20:40+00:00","first_seen_at":"2026-09-09T00:00:51.730848+00:00","date_source":"sitemap.lastmod"},{"id":"3af4f3d3-59a4-4686-94ba-6b6cacdd1091","url":"https://onlylabs.fyi/signals/3af4f3d3-59a4-4686-94ba-6b6cacdd1091","source_url":"https://www.baseten.co/blog/new-mcp-and-skill-for-coding-agents-to-use-baseten/","title":"New Mcp And Skill For Coding Agents To Use Baseten","context":null,"kind":{"key":"post_published","label":"Writing"},"org":{"slug":"baseten","name":"Baseten","category":"neocloud"},"occurred_at":"2026-09-02T18:20:19+00:00","first_seen_at":"2026-09-02T20:00:52.042916+00:00","date_source":"sitemap.lastmod"},{"id":"8dd84285-f6fb-49cb-a423-7039fcdde208","url":"https://onlylabs.fyi/signals/8dd84285-f6fb-49cb-a423-7039fcdde208","source_url":"https://www.baseten.co/blog/best-open-source-models-for-post-training/","title":"Best Open Source Models For Post Training","context":null,"kind":{"key":"post_published","label":"Writing"},"org":{"slug":"baseten","name":"Baseten","category":"neocloud"},"occurred_at":"2026-09-02T10:51:41+00:00","first_seen_at":"2026-09-02T12:01:45.497094+00:00","date_source":"sitemap.lastmod"},{"id":"9848b185-9578-4f96-8911-a25dba91ec70","url":"https://onlylabs.fyi/signals/9848b185-9578-4f96-8911-a25dba91ec70","source_url":"https://www.baseten.co/blog/the-efficient-frontier-of-llm-inference/","title":"The Efficient Frontier Of Llm Inference","context":null,"kind":{"key":"post_published","label":"Writing"},"org":{"slug":"baseten","name":"Baseten","category":"neocloud"},"occurred_at":"2026-09-01T23:47:31+00:00","first_seen_at":"2026-09-02T00:00:51.666285+00:00","date_source":"sitemap.lastmod"},{"id":"54f6a3fb-74e2-45ec-98c7-ee266104b764","url":"https://onlylabs.fyi/signals/54f6a3fb-74e2-45ec-98c7-ee266104b764","source_url":"https://www.baseten.co/resources/changelog/viewer-role-for-read-only-access/","title":"Viewer Role For Read Only Access","context":null,"kind":{"key":"post_published","label":"Writing"},"org":{"slug":"baseten","name":"Baseten","category":"neocloud"},"occurred_at":"2026-09-01T20:18:10+00:00","first_seen_at":"2026-09-02T00:00:51.666285+00:00","date_source":"sitemap.lastmod"}]}