mirror of
https://github.com/semantica-agi/semantica.git
synced 2026-09-12 04:01:35 +00:00
- Replace mock data with real feed URLs, APIs, and database patterns - Add real threat intelligence feeds (CISA, US-CERT, Security Week, Dark Reading) - Add real financial feeds (Reuters, CNN Money, Bloomberg, Financial Times) - Add real healthcare feeds (CDC, WHO) - Add real API endpoints (MITRE ATT&CK, NVD CVE API, Polygon.io, Alpha Vantage, FHIR APIs) - Add realistic database connection patterns with SQL queries - Add Kafka/RabbitMQ streaming configurations - Update all cybersecurity notebooks (5/5) with real sources - Update finance notebooks (2/2) with real sources - Update healthcare notebooks (1/1) with real sources - Create REAL_DATA_SOURCES.md documentation - Improve error handling with try-except blocks - Add batch processing for multiple feed URLs
5.4 KiB
5.4 KiB
In [ ]:
from semantica.kg import GraphBuilder
from semantica.semantic_extract import NERExtractor, RelationExtractor
builder = GraphBuilder()
ner_extractor = NERExtractor()
relation_extractor = RelationExtractor()
text = "Apple Inc. is a technology company. Tim Cook is the CEO of Apple Inc. Apple Inc. is headquartered in Cupertino, California."
entities_list = ner_extractor.extract(text)
relationships_list = relation_extractor.extract(text, entities_list)
entities = []
for i, entity in enumerate(entities_list[:5], 1):
entities.append({
"id": f"e{i}",
"type": entity.get("type", "Entity"),
"name": entity.get("text", entity.get("entity", "")),
"properties": {}
})
relationships = []
for i, rel in enumerate(relationships_list[:3], 1):
relationships.append({
"source": f"e{1}",
"target": f"e{i+1}",
"type": rel.get("type", "related_to"),
"properties": {}
})
knowledge_graph = builder.build(entities, relationships)
print(f"Built knowledge graph with {len(knowledge_graph.get('entities', []))} entities")
print(f"Relationships: {len(knowledge_graph.get('relationships', []))}")
In [ ]:
from semantica.kg import EntityResolver
entity_resolver = EntityResolver()
resolved_entities = entity_resolver.resolve(entities)
print(f"Original entities: {len(entities)}")
print(f"Resolved entities: {len(resolved_entities)}")
In [ ]:
from semantica.kg import GraphValidator
graph_validator = GraphValidator()
validation_result = graph_validator.validate(knowledge_graph)
print(f"Graph validation: {validation_result.get('valid', False)}")
print(f"Issues: {len(validation_result.get('issues', []))}")
In [ ]:
from semantica.kg import Deduplicator
deduplicator = Deduplicator()
deduplicated_graph = deduplicator.deduplicate(knowledge_graph)
print(f"Original entities: {len(knowledge_graph.get('entities', []))}")
print(f"Deduplicated entities: {len(deduplicated_graph.get('entities', []))}")